后端小知识

Python数据挖掘：入门进阶与实用案例分析-自动售货机销售数据分析与应用

⭐简单说两句⭐

作者：后端小知识

CSDN个人主页：后端小知识

GZH：后端小知识

欢迎关注点赞收藏⭐️留言

摘要： 本案例将主要结合自动售货机的实际情况，对销售的历史数据进行处理，利用pyecharts库、Matplotlib库进行可视化分析，并对未来4周商品的销售额进行预测，从而为企业制定相应的自动售货机市场需求分析及销售建议提供参考依据。更多详细内容请参考 ** 《Python数据挖掘：入门进阶与实用案例分析》**一书。

1.案例背景

近年来，随着我国经济技术的不断提升，自动化机械在人们日常生活中扮演着越来越重要的角色，更多的被应用在不同的领域。而作为新的一种自动化零售业态，自动售货机在日常生活中应用越来越广泛。自动售货机销售产业在走向信息化、合理化同时，也面临着高度同质化、成本上升、毛利下降等诸多困难与问题，这也是大多数企业所会面临到的问题。

为了提高市场占有率和企业的竞争力，某企业在广东省某8个市部署了376台自动售货机，但经过一段时间后，发现其经营状况并不理想。而如何了解销售额、订单数量与自动售货机数量之间的关系，畅销或滞销的商品又有哪些，自动售货机的销售情况等，已成为该企业亟待解决的问题。

分析目标

获取了该企业某6个月的自动售货机销售数据，结合销售背景进行分析，并可视化展现销售现状，同时预测未来一段时间内的销售额，从而为企业制定营销策略提供一定的参考依据。

分析过程

数据预处理

1. 清洗数据

1.1 合并订单表并处理缺失值

由于订单表的数据是按月份分开存放的，为了方便后续对数据进行处理和可视化，所以需要对订单数据进行合并处理。同时，在合并订单表的数据后，为了了解订单表的缺失数据的基本情况，需要进行缺失值检测。合并订单表并进行缺失值检测，操作结果如图1所示。

由操作结果可知，合并后的订单数据有350867条记录，且订单表中含有缺失值的记录总共有279条，其数量相对较少，可直接使用删除法对其中的缺失值进行处理。

合并订单表、查看缺失值并处理缺失值，如代码清单1所示。

代码清单1 合并订单表、查看缺失值并处理缺失值

import pandas as pd

 

# 读取数据

data4 = pd.read_csv('../data/订单表2018-4.csv', encoding='gbk')

data5 = pd.read_csv('../data/订单表2018-5.csv', encoding='gbk')

data6 = pd.read_csv('../data/订单表2018-6.csv', encoding='gbk')

data7 = pd.read_csv('../data/订单表2018-7.csv', encoding='gbk')

data8 = pd.read_csv('../data/订单表2018-8.csv', encoding='gbk')

data9 = pd.read_csv('../data/订单表2018-9.csv', encoding='gbk')

# 合并数据

data = pd.concat([data4, data5, data6, data7, data8, data9], ignore_index=True)

print('订单表合并后的形状为', data.shape)

# 缺失值检测

print('订单表各属性的缺失值数目为：\n', data.isnull().sum())

data = data.dropna(how='any')  # 删除缺失值

1.2 增加“市”属性

为了满足后续的数据可视化需求，需要在订单表中增加“市”属性，操作结果如图2所示。

增加“市”属性如代码清单2所示。

代码清单2 增加“市”属性

# 从省市区属性中提取市的信息，并创建新属性

data['市'] = data['省市区'].str[3: 6]

print('经过处理后的数据前5行为：\n', data.head())

1.3 处理订单表中的“商品详情”属性

通过浏览订单表数据发现，在“商品详情”属性中存在有异名同义的情况，即两个名称不同的值所代表的实际意义是一致的，如“脉动青柠X1;”“脉动青柠x1;”等。因为此情况会对后面的分析结果造成一定的影响，所以需要对订单表中的“商品详情”属性进行处理，增加“商品名称”属性，如代码清单3所示。

代码清单3 处理订单表中的“商品详情”属性

# 定义一个需剔除字符的列表error_str

error_str = [' ', '(', ')', '（', '）', '0', '1', '2', '3', '4', '5', '6',

             '7', '8', '9', 'g', 'l', 'm', 'M', 'L', '听', '特', '饮', '罐',

             '瓶', '只', '装', '欧', '式', '&', '%', 'X', 'x', ';']

# 使用循环剔除指定字符

for i in error_str:

    data['商品详情'] = data['商品详情'].str.replace(i, '')

# 新建“商品名称”属性，用于新数据的存放

data['商品名称'] = data['商品详情']

1.4 处理“总金额（元）”属性

此外，当浏览订单表数据时，发现在“总金额（元）”属性中，存在极少订单的金额很小，如0、0.01等。在现实生活中，这种记录存在的情况极少，且这部分数据不具有分析意义。因此，在本案例中，对订单的金额小于0.5的记录进行删除处理，操作结果如图3所示。

由操作结果可知，删除前的数据行列数目为(350617, 17)，删除后的数据行列数目为(350450, 17)。

删除“总金额（元）”属性中订单的金额较少的记录如代码清单4所示。

代码清单4 删除“总金额（元）”属性中订单的金额较少的记录

# 删除金额较少的订单前的数据行列数目

print(data.shape)

# 删除金额较少的订单后的数据行列数目

data = data[data['总金额（元）'] >= 0.5]

print(data.shape)

2.属性选择

因为订单表中的“手续费（元）”“收款方”“软件版本”“省市区”“商品详情”“退款金额（元）”等属性对本案例的分析没有意义，所以需要对其进行删除处理，选择合适的属性，操作的结果如图4所示。

属性选择如代码清单5所示。

代码清单5 属性选择

# 对于订单表数据选择合适的属性

data = data.drop(['手续费（元）', '收款方', '软件版本', '省市区', '商品详情', '退款金额（元）'], axis=1)

print('选择后，数据属性为：\n', data.columns.values)

3.属性规约

在订单表“下单时间”属性中含有的信息量较多，并且存在概念分层的情况，需要对属性进行数据规约，提取需要的信息。提取相应的“小时”属性和“月份”属性，进一步泛化“小时”属性为“下单时间段”属性，规则如下：

Ø当小时≤5时，为“凌晨”；

Ø当5＜小时≤8时，为“早晨”；

Ø当8＜小时≤11时，为“上午”；

Ø当11＜小时≤13时，为“中午”；

Ø当13＜小时≤16时，为“下午”；

Ø当16＜小时≤19时，为“傍晚”；

Ø当19＜小时≤24，为“晚上”。

在Python中规约订单表的属性，如代码清单6所示。

代码清单6 规约订单表的属性

# 将时间格式的字符串转换为标准的时间格式

data['下单时间'] = pd.to_datetime(data['下单时间'])

data['小时'] = data['下单时间'].dt.hour  # 提取时间中的小时

data['月份'] = data['下单时间'].dt.month  # 提取时间中的月份

data['下单时间段'] = 'time'  # 新增“下单时间段”属性，并将其初始化为time

exp1 = data['小时'] <= 5  # 判断小时是否小于等于5

# 若条件为真，则时间段为凌晨

data.loc[exp1, '下单时间段'] = '凌晨'

# 判断小时是否大于5且小于等于8

exp2 = (5 < data['小时']) & (data['小时'] <= 8)

# 若条件为真，则时间段为早晨

data.loc[exp2, '下单时间段'] = '早晨'

# 判断小时是否大于8且小于等于11

exp3 = (8 < data['小时']) & (data['小时'] <= 11)

# 若条件为真，则时间段为上午

data.loc[exp3, '下单时间段'] = '上午'

# 判断小时是否小大于11且小于等于13

exp4 = (11 < data['小时']) & (data['小时'] <= 13)

# 若条件为真，则时间段为中午

data.loc[exp4, '下单时间段'] = '中午'

# 判断小时是否大于13且小于等于16

exp5 = (13 < data['小时']) & (data['小时'] <= 16)

# 若条件为真，则时间段为下午

data.loc[exp5, '下单时间段'] = '下午'

# 判断小时是否大于16且小于等于19

exp6 = (16 < data['小时']) & (data['小时'] <= 19)

# 若条件为真，则时间段为傍晚

data.loc[exp6, '下单时间段'] = '傍晚'

# 判断小时是否大于19且小于等于24

exp7 = (19 < data['小时']) & (data['小时'] <= 24)

# 若条件为真，则时间段为晚上

data.loc[exp7, '下单时间段'] = '晚上'

data.to_csv('../tmp/order.csv', index=False, encoding = 'gbk')

销售数据可视化分析

在销售数据中含有的数据量较多，作为企业管理人员以及决策制定者，无法直观了解目前自动售货机的销售状况。因此需要利用处理好的数据进行可视化分析，直观地展示销售走势以及各区销售情况等，为决策者提供参考。

1.销售额和自动售货机数量的关系

探索6个月销售额和自动售货机数量之间的关系，并按时间走势进行可视化分析，结果如图5所示。

由图5可知，4月至7月，自动售货机的数量在增加，销售额也随着自动售货机的数量增加而增加；8月，虽然自动售货机数量减少了4台，但是销售额还在增加；9月相比8月的自动售货机数量减少了6台，销售额也随着减少。可以推断出销售额与自动售货机的数量存在一定的相关性，增加自动售货机的数量将会带来销售额的增长。出现该情况可能是因为广东处于亚热带，气候相对炎热，而7、8、9月的气温也相对较高，人们使用自动售货机的频率也相对较高。

探索销售额和自动售货机数量之间的关系如代码清单7所示。

代码清单7 销售额和自动售货机数量之间的关系

import pandas as pd

import numpy as np

from pyecharts.charts import Line

from pyecharts import options as opts

import matplotlib.pyplot as plt

from pyecharts.charts import Bar

from pyecharts.charts import Pie

from pyecharts.charts import Grid

 

data = pd.read_csv('../tmp/order.csv', encoding='gbk')

def f(x):

    return len(list(set((x.values))))

# 绘制销售额和自动售货机数量之间的关系图

groupby1 = data.groupby(by='月份', as_index=False).agg({'设备编号': f, '总金额（元）': np.sum})

groupby1.columns = ['月份', '设备数量', '销售额']

line = (Line()

        .add_xaxis([str(i) for i in groupby1['月份'].values.tolist()])

        .add_yaxis('销售额', np.round(groupby1['销售额'].values.tolist(), 2))

        .add_yaxis('设备数量', groupby1['设备数量'].values.tolist(), yaxis_index=1,symbol='triangle')

        .set_series_opts(label_opts=opts.LabelOpts(is_show=True, position='top', font_size=10))

        .set_global_opts(

            xaxis_opts=opts.AxisOpts(name='月份', name_location='center', name_gap=25),

            title_opts=opts.TitleOpts(title='销售额和自动售货机数量之间的关系'),

            yaxis_opts=opts.AxisOpts( name='销售额（元）', name_location='center', name_gap=60,

                axislabel_opts=opts.LabelOpts(

                formatter='{value}')))

        .extend_axis(

            yaxis=opts.AxisOpts( name='设备数量（台）', name_location='center', name_gap=40,

                axislabel_opts=opts.LabelOpts(

                formatter='{value}'), interval=50))

        )

line.render_notebook()

2.订单数量和自动售货机数量的关系

探索6个月订单数量和自动售货机数量之间的关系，并按时间走势进行可视化分析，结果如图6所示。

由图6可知，4月至7月，自动售货机数量呈上升趋势，订单数量也随着自动售货机数量增加而增加，而8月至9月，自动售货机数量在减少，订单数量也在减少。这说明了订单数量与自动售货机的数量是严格相关的，增加自动售货机会给用户带来便利，从而提高订单数量。同时，结合图5可知，订单数量和销售额的变化趋势基本保持一样的变化趋势，这也说明了订单数量和销售额存在一定的相关性。

由于各市的设备数量并不一致，所以探索各市自动售货机的平均销售总额，并进行对比分析，结果如图7所示。

由图7可知，深圳市自动售货机平均销售总额最高，达到了6538.28元，排在其后的是珠海市和中山市。而最少的是清远市，其平均销售总额只有414.27元。出现此情况可能是因为不同区域的人流量不同，而深圳市相对于其他区域的人流量相对较大，清远市相对于其他区域的人流量相对较小。此外，广州市的人流量也相对较大，但其平均销售总额却相对较少，可能是因为自动售货机放置不合理导致的。

探索订单数量和自动售货机数量之间的关系，以及各市自动售货机的平均销售总额如代码清单8所示。

代码清单8 订单数量和自动售货机数量之间的关系

groupby2 = data.groupby(by='月份', as_index=False).agg({'设备编号': f, '订单编号': f})

groupby2.columns = ['月份', '设备数量', '订单数量']

# 绘制图形

plt.figure(figsize=(10, 4))

plt.rcParams['font.sans-serif'] = ['SimHei']

plt.rcParams['axes.unicode_minus'] = False

fig, ax1 = plt.subplots()  # 使用subplots函数创建窗口

ax1.plot(groupby2['月份'], groupby2['设备数量'], '--')

ax1.set_yticks(range(0, 350, 50))  # 设置y1轴的刻度范围

ax1.legend(('设备数量',), loc='upper left', fontsize=10)

ax2 = ax1.twinx()  # 创建第二个坐标轴

ax2.plot(groupby2['月份'], groupby2['订单数量'])

ax2.set_yticks(range(0, 100000, 10000))  # 设置y2轴的刻度范围

ax2.legend(('订单数量',), loc='upper right', fontsize=10)

ax1.set_xlabel('月份')

ax1.set_ylabel('设备数量（台）')

ax2.set_ylabel('订单数量（单）')

plt.title('订单数量和自动售货机数量之间的关系')

plt.show()

 

gruop3 = data.groupby(by='市', as_index=False).agg({'总金额（元）':sum, '设备编号':f})

gruop3['销售总额'] = np.round(gruop3['总金额（元）'], 2)

gruop3['平均销售总额'] = np.round(gruop3['销售总额'] / gruop3['设备编号'], 2)

plt.bar(gruop3['市'].values.tolist(), gruop3['平均销售总额'].values.tolist(), color='#483D8B')

# 添加数据标注

for x, y in enumerate(gruop3['平均销售总额'].values):

    plt.text(x - 0.4, y + 100, '%s' %y, fontsize=8)

plt.xlabel('城市')

plt.ylabel('平均销售总额（元）')

plt.title('各市自动售货机平均销售总额')

plt.show()

3.畅销和滞销商品

查找6个月销售额排名前10和后10的商品，从而找出畅销商品和滞销商品，并对其销售额进行可视化分析，结果如图8、图9所示。

由图8可知，销售额排在第一的是商品0015，达到了56230.2元，其次是商品0013和商品0004等商品。由图9可知，销售额排在最后的商品是商品0104、商品0687和商品0540，其销售金额只有1元。

探索6个月销售额排名前10和后10的商品如代码清单9所示。

代码清单9 10种畅销商品、10种滞销商品

# 销售额前10的商品

group4 = data.groupby(by='商品ID', as_index=False)['总金额（元）'].sum()

group4.sort_values(by='总金额（元）', ascending=False, inplace=True)

d = group4.iloc[: 10]

x_data = d['商品ID'].values.tolist()

y_data = np.round(d['总金额（元）'].values, 2).tolist()

bar = (Bar(init_opts=opts.InitOpts(width='800px',height='600px'))

       .add_xaxis(x_data)

       .add_yaxis('', y_data, label_opts=opts.LabelOpts(font_size=15))

       .set_global_opts(title_opts=opts.TitleOpts(title='畅销前10的商品'),

                        yaxis_opts=opts.AxisOpts(axislabel_opts=opts.LabelOpts(

                            formatter='{value}',font_size=15)),

                        xaxis_opts=opts.AxisOpts(type_='category',

                            axislabel_opts=opts.LabelOpts({'interval': '0'}, font_size=15, rotate=30))))

bar.render_notebook()

 

h = group4.iloc[-10: ]

x_data = h['商品ID'].values.tolist()

y_data = np.round(h['总金额（元）'].values, 2).tolist()

bar = (Bar()

       .add_xaxis(x_data)

       .add_yaxis('', y_data, label_opts=opts.LabelOpts(position='right'))

       .set_global_opts(title_opts=opts.TitleOpts(

                        title='滞销前10的商品'),

                        xaxis_opts=opts.AxisOpts(

                            axislabel_opts={'interval': '0'}))

       .reversal_axis()

       )

grid = Grid(init_opts=opts.InitOpts(width='600px', height='400px'))

grid.add(bar, grid_opts=opts.GridOpts(pos_left='18%'))

grid.render_notebook()

4.自动售货机的销售情况

探索6个月销售额前10以及销售额后10的设备及其所在的城市，并进行可视化分析，结果如图10、图11所示。

由图10可知，销售额靠前的设备所在城市主要集中在中山市、广州市、东莞市和深圳市，其中，销售额前3的设备都集中在中山市。由图11可知，广州市的设备113024、112719、112748的销售额只有1元，而销售额后10的设备全部在广州市和中山市。

探索6个月销售额前10以及销售额后10的设备及其所在的城市如代码清单10所示。

代码清单10 销售额前10、后10的设备及其所在市

group5 = data.groupby(by=['市', '设备编号'], as_index=False)['总金额（元）'].sum()

group5.sort_values(by='总金额（元）', ascending=False, inplace=True)

b = group5[: 10]

label = []

# 销售额前10的设备及其所在市

for i in range(len(b)):

    a = b.iloc[i, 0] + str(b.iloc[i, 1])

    label.append(a)

x = np.round(b['总金额（元）'], 2).values.tolist()

y = range(10)

plt.bar(x=0, bottom=y, height=0.4, width=x, orientation='horizontal')

plt.xticks(range(0, 80000, 10000))  # 设置x轴的刻度范围

plt.yticks(range(10), label)

for y, x in enumerate(np.round(b['总金额（元）'], 2).values):

    plt.text(x + 500, y - 0.2, "%s" %x)

plt.xlabel('总金额（元）')

plt.title('销售额前10的设备及其所在市')

plt.show()

 

l = group5[-10: ]

label1 = []

for i in range(len(l)):

    a = l.iloc[i, 0] + str(l.iloc[i, 1])

    label1.append(a)

x = np.round(l['总金额（元）'], 2).values.tolist()

y = range(10)

plt.bar(x=0, bottom=y, height=0.4, width=x, orientation='horizontal')

plt.xticks(range(0, 4, 1))  # 设置x轴的刻度范围

plt.yticks(range(10), label1)

for y, x in enumerate(np.round(l['总金额（元）'], 2).values):

    plt.text(x, y, "%s" %x)

plt.xlabel('总金额（元）')

plt.title('销售额后10的设备及其所在市')

plt.show()

统计各城市销售额小于100的设备数量，并进行可视化分析，结果如图12所示。

由图12可知，销售额小于100的设备在广州市有52台，中山市有20台，佛山市有10台。出现这种情况的原因可能是设备放置位置的不合理，或设备放置过多造成的，因此可以适当调整自动售货机放置的位置和数量，减少设备和人员的浪费。

探索各城市销售额小于100元的设备数量如代码清单11所示。

代码清单11 各城市销售额小于100元的设备数量

l_b = group5[group5['总金额（元）'] < 100]

lb = l_b.groupby(by='市', as_index=False)['设备编号'].count()

x_data = lb['市'].values.tolist()

y_data = lb['设备编号'].values.tolist()

bar = (Bar(init_opts=opts.InitOpts(width='500px', height='400px'))

       .add_xaxis(x_data)

       .add_yaxis('', y_data)

       .set_global_opts(title_opts=opts.TitleOpts(

                title='各市销售额小于100的设备数量'))

       )

bar.render_notebook()

5.订单支付方式占比

对自动售货机上各商品订单的支付方式进行统计，并进行可视化分析，结果如图13所示。

由图13可知，订单的主要支付方式有4种，即微信、支付宝、会员余额和现金，其中支付方式最多的是微信支付，在所有支付方式中占到了89.05%。其次是支付宝支付，其占比为9.87%，而现金支付和会员余额支付的占比不到1%。

分析订单支付方式占比如代码清单12所示。

代码清单12 分析订单支付方式占比

group6 = data.groupby(by='支付状态')['支付状态'].count()

method = group6.index.tolist()

num = group6.values.tolist()

pie_data = [(i, j) for i, j in zip(method, num)]

pie = (Pie()

     .add('', pie_data, label_opts=opts.LabelOpts(formatter='{b}:{c}({d}%)'))

     .set_global_opts(title_opts=opts.TitleOpts(title='订单支付方式占比')))

pie.render_notebook()

6**.各消费时段的订单用户占比**

在自动售货机的商品下单时间段上，统计各消费时段的订单用户数量，并进行可视化分析，结果如图14所示。

图14 各消费时段的订单用户占比

由图14可知，当消费时间段在下午时，其订单用户最多，占比达到了21.44%，其次是晚上，占比是17.36%，上午的占比也有17.08%，其余时间段的占比相对较少。

分析各消费时段的订单用户如代码清单13所示。

代码清单13 分析各消费时段的订单用户

group7 = data.groupby(by='下单时间段')['购买用户'].count()

times = group7.index.tolist()

num = group7.values.tolist()

pie_data_2 = [(i, j) for i, j in zip(times, num)]

pie = (Pie()

       .add('', pie_data_2, label_opts=opts.LabelOpts(formatter='{b}:{c}({d}%)'),

            radius=[60, 200], rosetype='radius', is_clockwise=False)

       .set_global_opts(title_opts=opts.TitleOpts(title='各消费时段的订单用户占比'))

       )

pie.render_notebook()

销售额预测

精准的销售额预测对于企业运营有着非常重要的指导意义，可以指导运营后台提前进行合理的资源配置，帮助企业管理人员制定合理的目标。同时，还可以更好地帮助企业采取更为针对性的促销手段，更加明确市场的需求，可以根据不同区域、不同时间划分等制定更加有效、合理的配货方案和商品价格，从而增加企业经营收益。

自动售货机的销售额预测指的是从售货机已有销售额的订单数据资料中，总结出商品销售额的变化规律，并根据该规律构建ARIMA模型，动态预测未来4周内商品的销售额。

ARIMA模型的建模步骤如图15所示。

图15 ARIMA模型的建模步骤

1.统计周销售额

通过观察订单数据，发现该数据集记录的是当前日期时间下，售货机所售卖商品的订单状况，其出货状态有出货成功、出货失败、未出货等多种情况。然而，为预测未来4周的销售额，其所需样本数据应为实际的周销售额数据，因此，需要筛选状态为出货成功的数据并统计各周销售额，如代码清单14所示。

代码清单14 筛选出货成功数据并统计各周销售额

import pandas as pd

import matplotlib.pyplot as plt

from statsmodels.tsa.stattools import adfuller as ADF

from statsmodels.graphics.tsaplots import plot_acf

from statsmodels.stats.diagnostic import acorr_ljungbox

from statsmodels.tsa.arima_model import ARIMA

 

data = pd.read_csv('../tmp/order.csv', encoding='gbk')

# 提取出货状态为“出货成功”的下单时间和总金额（元）数据

data_info = data.loc[data['出货状态'] == '出货成功', ['下单时间', '总金额（元）']]

data_info = data_info.set_index('下单时间')  # 将下单时间设为索引

# 将索引修改为日期时间格式

data_info.index = pd.to_datetime(data_info.index)

# 按周对总金额进行汇总，即求和

data_w = data_info.resample('W').sum()

2.平稳性检验

在使用ARIMA模型进行销售额预测之前，需要查看时间序列是否平稳，若数据非平稳，在数据分析挖掘的时候，则可能会产生“伪回归”等问题，从而影响分析结果。通过时间序列的时序图、自相关图及其单位根查看时间序列平稳性，时序图如图16所示，自相关图如图17所示，单位根检验结果如图18所示。

图16 原始序列的时序图

图17 原始序列的自相关图

图18 原始序列的单位根检验结果

由图16可知，时序图显示该序列具有明显的递增趋势，可以判断为原始序列数据是非平稳序列；图17的自相关图显示的自相关系数大部分均大于零，说明序列间具有一定的长期相关性。由图18可知，在单位根检验统计量中，p值为0.251134，其值显著大于0.05，可以推断出该序列为非平稳序列（非平稳序列一定不是白噪声序列）。

绘制时序图、自相关图并进行单位根检验如代码清单15所示。

代码清单15 绘制时序图、自相关图并进行单位根检验

# 平稳性检验

# 判断是否为时间序列

plt.rcParams['font.sans-serif'] = ['SimHei']  # 显示中文标签

plt.rcParams['axes.unicode_minus'] = False  # 显示负号

plt.figure(figsize=(8, 5))

plt.plot(data_w)

plt.tick_params(labelsize=14)  # 设置坐标轴字体大小

plt.show()

 

# 定义绘制自相关图函数

def draw_acf(ts):

    plt.figure(facecolor='white', figsize=(10, 8))

    plot_acf(ts)

    plt.show()

# 定义单位根检验函数

def testStationarity(ts):

    dftest = ADF(ts)

    # 对ADF求得的值进行语义描述

    dfoutput = pd.Series(dftest[0:4], index = ['Test Statistic','p-value','#Lags Used',

                                               'Number of Observations Used'])

    for key, value in dftest[4].items():

        dfoutput['Critical Value (%s)'%key] = value

    return dfoutput

 

# 自相关

draw_acf(data_w)

# 单位根检验

print('单位根检验结果为：\n', testStationarity(data_w))

3.差分处理

在进行平稳性检验后，发现原始序列数据属于非平稳序列，而在使用ARIMA模型进行销售额预测时，需要序列数据是平稳序列，以避免序列中的随机游走形势影响预测结果。在Python中，可以通过二阶差分处理对数据进行平稳化操作，并查看二阶差分之后序列的平稳性和白噪声，其中二阶差分后序列的时序图如图19所示，二阶差分后序列的自相关图如图20所示，二阶差分后序列的单位根检验结果如图21所示，二阶差分后序列的白噪声检验结果如图22所示。

图19 二阶差分后序列的时序图

图20 二阶差分后序列的自相关图

图21 二阶差分后序列的单位根检验结果

图22 二阶差分后序列的白噪声检验结果

由图19可知，该序列无明显趋势，较为稳定；图20的自相关图显示自相关系数较为均匀，且较为接近于0，有较强的短期相关性。由图21可知，二阶差分后序列的单位根检验p值远小于0.05，可以判断出差分处理后的序列是平稳序列。由图22可知，在白噪声检验结果中，输出的p值小于0.05，同时结合单位根检验结果可以判断二阶差分之后的序列是平稳非白噪声序列。

差分处理并查看序列平稳性和白噪声如代码清单16所示。

代码清单16 差分处理并查看序列平稳性和白噪声

# 二阶差分处理

data_w_T1 = data_w.diff().dropna()

data_w_T2 = data_w_T1.diff().dropna()

# 差分后的时间序列图

plt.figure(figsize=(8, 5))

plt.plot(data_w_T2)

plt.tick_params(labelsize=14)

plt.show()

 

# 差分自相关

draw_acf(data_w_T2)

# 差分单位根检验

print('差分单位根检验结果为：\n', testStationarity(data_w_T2))

# 白噪声检验

print('差分白噪声检验结果为：\n', acorr_ljungbox(data_w_T2, lags=1))

**4.**模型定阶

通常情况下，在进行模型预测前，需要寻找最优模型，以提高预测结果的准确性。针对ARIMA模型，可以通过BIC矩阵进行模型定阶。由于4.4.3小节进行了二阶差分处理，所以d＝2。通过计算ARIMA(p,2,q)中所有组合的BIC信息量，取最小BIC信息量所对应的模型阶数，进而确定p值和q值，结果如图23所示。

图23 模型定阶

由操作结果可知，当p值为0、q值为1时，BIC值最小，到此p、q定阶完成。

模型定阶如代码清单17所示。

代码清单17 模型定阶

# 通过BIC矩阵进行模型定阶

data_w = data_w.astype(float)

pmax = 3

qmax = 3

bic_matrix = []  # 初始化BIC矩阵

for p in range(pmax+1):

    tmp = []

    for q in range(qmax+1):

        try:

            tmp.append(ARIMA(data_w, (p, 2, q)).fit().bic)

        except:

            tmp.append(None)

        bic_matrix.append(tmp)

bic_matrix = pd.DataFrame(bic_matrix)

# 找出最小值位置

p, q = bic_matrix.stack().idxmin()

print('当BIC最小时，p值和q值分别为: ', p, q)

5.模型预测

应用ARIMA(0, 2, 1)模型对未来4周内商品的销售额进行预测，结果如图24所示。

图24预测未来4周的销售额

预测未来4周内商品的销售额如代码清单18所示。

代码清单18 预测未来4周内商品的销售额

# 构建ARIMA(0, 2, 1)模型

model = ARIMA(data_w, (p, 2, q)).fit()

# 预测未来4周的销售额

print('预测未来4周的销售额，其预测结果、标准误差、置信区间如下。\n', model.forecast(4))

注：利用ARIMA模型向前预测的周期越长，其误差越大。

正版链接：https://item.jd.com/13814157.html

**《Python数据挖掘：入门、进阶与实用案例分析》**是一本以项目实战案例为驱动的数据挖掘著作，它能帮助完全没有Python编程基础和数据挖掘基础的读者快速掌握Python数据挖掘的技术、流程与方法。在写作方式上，与传统的“理论与实践结合”的入门书不同，它以数据挖掘领域的知名赛事“泰迪杯”数据挖掘挑战赛（已举办10届）和“泰迪杯”数据分析技能赛（已举办5届）（累计1500余所高校的10余万师生参赛）为依托，精选了11个经典赛题，将Python编程知识、数据挖掘知识和行业知识三者融合，让读者在实践中快速掌握电商、教育、交通、传媒、电力、旅游、制造等7大行业的数据挖掘方法。

本书不仅适用于零基础的读者自学，还适用于教师教学，为了帮助读者更加高效地掌握本书的内容，本书提供了以下10项附加价值：
（1）建模平台：提供一站式大数据挖掘建模平台，免配置，包含大量案例工程，边练边学，告别纸上谈兵
（2）视频讲解：提供不少于600分钟Python编程和数据挖掘相关教学视频，边看边学，快速收获经验值
（3）精选习题：精心挑选不少于60道数据挖掘练习题，并提供详细解答，边学边练，检查知识盲区
（4）作者答疑：学习过程中有任何问题，通过“树洞”小程序，纸书拍照，一键发给作者，边问边学，事半功倍
（5）数据文件：提供各个案例配套的数据文件，与工程实践结合，开箱即用，增强实操性
（6）程序代码：提供书中代码的电子文件及相关工具的安装包，代码导入平台即可运行，学习效果立竿见影
（7）教学课件：提供配套的PPT课件，使用本书作为教材的老师可以申请，节省备课时间
（8）模型服务：提供不少于10个数据挖掘模型，模型提供完整的案例实现过程，助力提升数据挖掘实践能力
（9）教学平台：泰迪科技为本书提供的附加资源提供一站式数据化教学平台，附有详细操作指南，边看边学边练，节省时间
（10）就业推荐：提供大量就业推荐机会，与1500+企业合作，包含华为、京东、美的等知名企业

通过学习本书，读者可以理解数据挖掘的原理，迅速掌握大数据技术的相关操作，为后续数据分析、数据挖掘、深度学习的实践及竞赛打下良好的技术基础。

【都看到这了，点点赞点点关注呗，爱你们】

结语

谢谢你的阅读，由于作者水平有限，难免有不足之处，若读者发现问题，还请批评，在留言区留言或者私信告知，我一定会尽快修改的。若各位大佬有什么好的解法，或者有意义的解法都可以在评论区展示额，万分谢谢。
写作不易，望各位老板点点赞，加个关注!

作者：后端小知识

CSDN个人主页：后端小知识

GZH：后端小知识

欢迎关注点赞收藏⭐️留言

你可能感兴趣的:(福利,数据分析,python,数据挖掘,开发语言)

一份Python面试宝典小夕Coding Python大学作业汇总 python 面试开发语言
Python面试宝典文章目录Python面试宝典题目001:在Python中如何实现单例模式。题目002：不使用中间变量，交换两个变量`a`和`b`的值。题目003：写一个删除列表中重复元素的函数，要求去重后元素相对位置保持不变。题目004：假设你使用的是官方的CPython，说出下面代码的运行结果。题目005：Lambda函数是什么，举例说明的它的应用场景。题目006：说说Python中的浅拷贝
python中的下划线用法总结白色机械键盘 python实践 python 开发语言
在Python中，下划线（underscore）有多种用法。它在不同的上下文中可以扮演不同的角色，下面是其常见用法的总结：1.单下划线"_"1.1作为临时变量或无用变量在循环或解包操作中，表示一个临时的或不关心的变量。for_inrange(5):print("Hello,World!")a,_,b=(1,2,3)print(a,b)#输出:131.2在交互式解释器中在交互式解释器中，"_"用于保
西交建筑学本科秋天毕业想转码，自学了Python+408，华为OD社招还是考研更香？程序员yt python 华为od 考研
今天给大家分享的是一位粉丝的提问，西交建筑学本科秋天毕业想转码，自学了Python+408，华为OD社招还是考研更香？接下来把粉丝的具体提问和我的回复分享给大家，希望也能给一些类似情况的小伙伴一些启发和帮助。同学提问：本科就读于西安交通大学建筑学，今年21岁，秋天毕业，不想在建筑行业，想转码，现在在学Python以及计算机408课程，在Boss上投了很多的岗位好像都是华为OD社招，我毕业应该去试试
python技巧之下划线老虎也淘气 Python编程掌握指南 python django 开发语言
‍♂️个人主页@老虎也淘气个人主页✍作者简介：Python学习者希望大家多多支持我们一起进步！如果文章对你有帮助的话，欢迎评论点赞收藏加关注python技巧之下划线1、python的moudles文件中__all__作用2、__slots__用于限定类属性，如：3、下面的小技巧可以获取私有变量：4、下划线种类单个下划线（_）单下划线前缀的名称（例如_shahriar）双下划线前缀的名称（例如__s
【华为OD-E卷 -123 判断一组不等式是否满足约束并输出最大差 100分（python、java、c++、js、c）】 CodeClimb 算法题华为od （A+B+C+D+E 卷）收录分享华为od python java javascript c++
【华为OD-E卷-判断一组不等式是否满足约束并输出最大差100分（python、java、c++、js、c）】题目给定一组不等式，判断是否成立并输出不等式的最大差(输出浮点数的整数部分)要求:不等式系数为double类型，是一个二维数组不等式的变量为int类型，是一维数组;不等式的目标值为double类型，是一维数组不等式约束为字符串数组，只能是:“>”,“>=”,“<”,“<=”,“=”，例如，
【华为OD-E卷 -122 字符统计及重排 100分（python、java、c++、js、c）】 CodeClimb 算法题华为od （A+B+C+D+E 卷）收录分享 python 华为od java c++javascript
【华为OD-E卷-字符统计及重排100分（python、java、c++、js、c）】题目给出一个仅包含字母的字符串，不包含空格，统计字符串中各个字母（区分大小写）出现的次数，并按照字母出现次数从大到小的顺序。输出各个字母及其出现次数。如果次数相同，按照自然顺序进行排序，且小写字母在大写字母之前输入描述输入一行，为一个仅包含字母的字符串输出描述按照字母出现次数从大到小的顺序输出各个字母和字母次数，
【华为OD-E卷-02 最多提取子串数目100分（python、java、c++、js、c）】 CodeClimb 算法题华为od （A+B+C+D+E 卷）收录分享华为od python java c++javascript
【华为OD-E卷-最多提取子串数目100分（python、java、c++、js、c）】题目给定[a-z]，26个英文字母小写字符串组成的字符串A和B，其中A可能存在重复字母，B不会存在重复字母，现从字符串A中按规则挑选一些字母，可以组成字符串B。挑选规则如下：同一个位置的字母只能挑选一次被挑选字母的相对先后顺序不能被改变求最多可以同时从A中挑选多少组能组成B的字符串。输入描述输入为2行，第1行输
聊聊Python都能做些什么 ·零落· Python入门到掌握 python 开发语言
文章目录一、Python简介二、Python都能做些什么1.Web开发2.数据分析和人工智能3.自动化运维和测试4.网络爬虫5.金融科技三、Python开源库都有哪些1.Web开发2.数据分析和科学计算3.机器学习和深度学习4.网络爬虫5.自动化和测试6.其他常用库四、相关链接一、Python简介Python是一种解释型、面向对象、动态数据类型的高级程序设计语言。它最初由GuidovanRossu
【华为OD-E卷 - 高频题目全览（关注、收藏）通过率100%以上题目可达95%（python、java、c++、js、c）】 CodeClimb 算法题华为od （A+B+C+D+E 卷）收录分享纯小白编程入门教程（新手必看）计算机相关操作技巧（新手必看）华为od c++c语言 java python js javascript
注意：如果发现代码有用例覆盖不到的情况，欢迎反馈！会在第一时间修正，更新。解题不易，如对您有帮助，欢迎点赞/收藏E卷题目全览一键跳转详情题目详情跳转01补种未成活胡杨点此跳转详情02最多提取子串数目点此跳转详情03ai面板识别点此跳转详情04流浪地球
python的try和except_Python 异常处理(Try...Except) weixin_40001309
版权所有，未经许可，禁止转载try块让你可以检测代码块中的错误。except块让你可以处理错误。finally块让你可以执行最终代码，不管try与except块的结果如何，finally块的代码都将执行。异常处理当错误(或者异常)发生时，Python通常会停止执行，并报错。这些异常可以使用try/except语句处理：示例下面try块会产生异常，因为x没有定义:try:print(x)except
美容院如何通过数据分析降低顾客流失率 shboka920702 信息可视化
美容行业的竞争日益激烈，顾客流失率居高不下已成为许多美容院面临的共同难题。根据《美容行业经营分析报告》的数据，美容行业的平均顾客流失率高达40%，这意味着每10位顾客中就有4位在一年内不再光顾。如何通过数据分析降低顾客流失率，成为美容院经营者亟需解决的问题。顾客流失的原因多种多样，主要包括服务质量、价格、环境、竞争对手等。根据《消费者行为研究》期刊的调查，超过50%的顾客流失是由于服务质量不达标，
一文掌握python异常处理（try...except...）程序员neil python python 开发语言
目录1、基础结构2、try块3、except块4、else块5、finally块6、自定义异常7、抛出异常8、常用的内置异常类型1）、Exception：捕捉所有异常。2）、BaseException：所有异常的基类。通常不应该直接捕获这个类的实例，除非你确实打算捕获所有异常。3）、SyntaxError：Python语法错误，比如拼写错误或不正确的语句结构。4）、ImportError：尝试导入
利用Python进行数据可视化（Plotly与Dash的应用）步入烟尘 Python超入门指南全册信息可视化 python plotly
本文已收录于《Python超入门指南全册》本专栏专门针对零基础和需要进阶提升的同学所准备的一套完整教学，从基础到精通不断进阶深入，后续还有实战项目，轻松应对面试，专栏订阅地址：https://blog.csdn.net/mrdeam/category_12647587.html优点：订阅限时19.9付费专栏，私信博主还可进入全栈VIP答疑群，作者优先解答机会（代码指导、远程服务），群里大佬众多可以
python中 except与 except Exception as e的区别东木月 python python性能提升 python 开发语言
python中except与exceptExceptionase的区别1、捕获所有异常使用except#-*-coding:utf-8-*-"""@contact:微信1257309054@file:except与exceptExceptionase的区别.py@time:2024/4/1313:26@author:LDC"""importsysdeffun1():try:sys<
《基于机器学习的负荷曲线聚类算法对比与改进：K-L-isodata的创新性研究》 TWHiwhjig 机器学习算法聚类
基于机器学习的负荷曲线聚类包括kmeansisodata和改进的L-isodata以及在其基础上再次进行改进的K-L-isodata(有创新性)，四者通过评价指标进行了对比精品代码可修改性极高有参考文献ID:93150688324967700自律的电气人基于机器学习的负荷曲线聚类是一种基于数据分析和模式识别的技术，它可以帮助我们对系统的负荷变化进行分类和理解。在负荷曲线聚类的研究中，K-means
编程提示异常就不用挨个度娘了——Python初识必备爱码小士 Python 网络爬虫机器学习 web开发人工智能
相信对于很多小白，新手对一些异常提示，都不一定明白其含义，所以给大家整理了这样一份中英对照表，对大家一定有所帮助，当然最好都能熟记于心，这样就不用再去一个个度娘了，觉得这个表不错就点个赞加转发吧，文末更多福利异常名称描述BaseException所有异常的基类SystemExit解释器请求退出KeyboardInterrupt用户中断执行(通常是输入^C)Exception常规错误的基类StopI
Python实现自动提取目标文档的大纲（13）写python的鑫哥 Python办公自动化 python 自动提取 Word 文档大纲编号
前言本文是该专栏的第13篇，后面会持续分享Python办公自动化干货知识，记得关注。大纲是一种用于组织和呈现内容结构的工具，它通过层次化的形式展示信息的框架和重点。其通常用于规划、整理和总结文档、报告、演讲、论文或其他任何形式的写作和表达。它可以帮助作者或演讲者清晰地梳理思路，确保内容的逻辑性和连贯性，同时也便于读者或听众快速了解整体结构和重点内容。而本文，笔者也重点来讲述通过Python，如何来
《Python实战进阶》No26: CI/CD 流水线：GitHub Actions 与 Jenkins 集成带娃的IT创业者 Python实战进阶 python ci/cd github
No26:CI/CD流水线：GitHubActions与Jenkins集成摘要持续集成（CI）和持续部署（CD）是现代软件开发中不可或缺的实践，能够显著提升开发效率、减少错误并加速交付流程。本文将探讨如何利用GitHubActions和Jenkins构建高效的CI/CD流水线，并通过实战案例展示如何自动化构建、测试和部署Python应用程序。无论你是个人开发者还是团队成员，本文都将帮助你掌握CI/
python tcl,Python tcl没有正确安装邓永泉 python tcl
Ijustinstalledgraphics.pyforpython.Then,whenItriedtorunthefollowingcode:fromgraphicsimport*defmain():win=GraphWin("MyCircle",100,100)c=Circle(Point(50,50),10)c.draw(win)win.getMouse()#Pausetoviewresul
【Python】解析 XML 茉菇 Python python xml
1、Python对XML的解析1.1SAX(simpleAPIforXML)SAX解析器使用事件驱动模型，通过在解析XML的过程中触发一个个的事件并调用用户定义的回调函数来处理XML文件。xml.sax模块牺牲了便捷性来换取速度和内存占用。事件驱动指一种基于回调（callback）机制的程序运行方法。利用SAX解析XML文档牵涉到两个部分:解析器：负责读取XML文档，并向事件处理器发送事件，如元素
python中使用单例模式在整个程序中只创建一个数据库连接，节省资源背太阳的牧羊人 python 数据库数据库 python 单例模式
示例代码：fromloguruimportloggerfrompymongoimportMongoClientfrompymongo.errorsimportConnectionFailurefromllm_engineering.settingsimportsettingsclassMongoDatabaseConnector:_instance:MongoClient|None=Nonedef
Python XML 解析 lsx202406 开发语言
PythonXML解析引言XML（可扩展标记语言）是一种用于存储和传输数据的标记语言。Python作为一种功能强大的编程语言，提供了多种解析XML的方法。本文将详细介绍Python中常用的XML解析方法，包括XML解析的基本概念、常用库以及解析实例。XML解析的基本概念1.XML文档结构XML文档由以下几部分组成：声明：声明XML版本和编码方式。根元素：文档中所有元素的父元素。元素：XML文档中的
Package SeqIO wangyiqi806643897
InputThemainfunctionisBio.SeqIO.parse(...)whichtakesaninputfilehandle(orinrecentversionsofBiopythonalternativelyafilenameasastring),andformatstring.ThisreturnsaniteratorgivingSeqRecordobjects:>>>fromB
蓝桥杯Python赛道备赛——Day8：动态规划（基础）案例分析 SKY YEAM 蓝桥杯备赛蓝桥杯 python 动态规划
本博客就上一期中讨论的蓝桥杯动态规划基础问题（包括：递推、记忆化搜索、最长公共子序列和最长上升子序列），给出了六个常见的案例问题。每一个问题都给出了其求解方法的示例代码，以供低年级师弟师妹们学习和练习。如有不懂，欢迎在评论区提问。前序知识：（1）Python基础语法（2）Day1：基础算法（3）Day7：动态规划（基础）动态规划（基础）案例分析一、递推应用：爬楼梯问题二、递推应用：零钱兑换三、记忆
如何使用Python对Excel、CSV文件完成数据清洗与预处理？ Python 集中营 python数据分析应用 python excel 开发语言
在数据分析和机器学习项目中，数据清洗与预处理是不可或缺的重要环节。现实世界中的数据往往是不完整、不一致且含有噪声的，这些问题会严重影响数据分析的质量和机器学习模型的性能。Python作为一门强大的编程语言，提供了多种库和工具来帮助我们高效地完成数据清洗与预处理任务，其中最常用的库包括Pandas、NumPy、SciPy等。本文将详细介绍如何使用Python对Excel和CSV格式的数据文件进行清洗
《我的Python觉醒之路》之转型Python（十五）——控制流 Python破壁人手记 python 服务器网络开发语言 java
[今天是2025年3月17日，继续复习第一章节、第二章节的内容]《我的Python觉醒之路》之转型Python（十四）——控制流
AI：188-利用Python进行自然语言生成和文本摘要一键难忘 python 开发语言人工智能自然语言处理
本文收录于专栏：精通AI实战千例专栏合集https://blog.csdn.net/weixin_52908342/category_11863492.html从基础到实践，深入学习。无论你是初学者还是经验丰富的老手，对于本专栏案例和项目实践都有参考学习意义。每一个案例都附带关键代码，详细讲解供大家学习，希望可以帮到大家。正在不断更新中~一.利用Python进行自然语言生成和文本摘要近年来，人工智
零基础Python快速入门：核心概念+基础语法详解中意可口可乐 python 开发语言
一、为什么选择Python？1.语言优势简洁易读：接近自然语言的语法结构#其他语言实现循环for(inti=0;i=3)#返回True#逻辑运算符print((5>3)and(2=90:grade='A'elifscore>=80:grade='B'#这里将执行该分支else:grade='C'循环结构#while循环count=0whilecount<3:print(f"第{count+1}次循
python后端常见架构_常见的后端框架 weixin_39622178 python后端常见架构
后端vs前端如果您是Web开发世界的新手，后端和前端开发之间的区别可能不那么明显，但是，了解两者之间的区别很重要。以下是前端开发人员与后端开发人员的一些区别。前端开发：前端开发人员在很大程度上负责用户所看到的内容(即网站页面)，前端开发人员主要使用HTML，CSS和JavaScript。他们的主要关注点是创建出色的用户体验，并确保网站设计和布局或Web应用程序始终具有凝聚力。后端开发：另一方面，后
【Python】字符串的常用方法 myjzwsz python 开发语言
Python的字符串是一种不可变序列类型，提供了许多内置的方法来处理文本数据。下面是一些常用的字符串方法：str.lower()-将所有字符转换为小写。str.upper()-将所有字符转换为大写。str.capitalize()-首字母大写，其余字母小写。str.title()-每个单词的首字母大写。str.swapcase()-大小写互换。str.strip([chars])-移除字符串头尾指
JAVA中的Enum 周凡杨 java enum 枚举
Enum是计算机编程语言中的一种数据类型---枚举类型。在实际问题中，有些变量的取值被限定在一个有限的范围内。例如，一个星期内只有七天我们通常这样实现上面的定义： public String monday; public String tuesday; public String wensday; public String thursday
赶集网mysql开发36条军规 Bill_chen mysql 业务架构设计 mysql调优 mysql性能优化
(一)核心军规 (1)不在数据库做运算 cpu计算务必移至业务层； (2)控制单表数据量 int型不超过1000w，含char则不超过500w；合理分表；限制单库表数量在300以内； (3)控制列数量字段少而精，字段数建议在20以内
Shell test命令 daizj shell 字符串 test 数字文件比较
Shell test命令 Shell中的 test 命令用于检查某个条件是否成立，它可以进行数值、字符和文件三个方面的测试。数值测试参数说明 -eq 等于则为真 -ne 不等于则为真 -gt 大于则为真 -ge 大于等于则为真 -lt 小于则为真 -le 小于等于则为真实例演示： num1=100 num2=100if test $[num1]
XFire框架实现WebService(二) 周凡杨 java webservice
有了XFire框架实现WebService(一)，就可以继续开发WebService的简单应用。 Webservice的服务端(WEB工程)：两个java bean类： Course.java package cn.com.bean; public class Course { private
重绘之画图板朱辉辉33 画图板
上次博客讲的五子棋重绘比较简单，因为只要在重写系统重绘方法paint（）时加入棋盘和棋子的绘制。这次我想说说画图板的重绘。画图板重绘难在需要重绘的类型很多，比如说里面有矩形，园，直线之类的，所以我们要想办法将里面的图形加入一个队列中，这样在重绘时就
Java的IO流西蜀石兰 java
刚学Java的IO流时，被各种inputStream流弄的很迷糊，看老罗视频时说想象成插在文件上的一根管道，当初听时觉得自己很明白，可到自己用时，有不知道怎么代码了。。。每当遇到这种问题时，我习惯性的从头开始理逻辑，会问自己一些很简单的问题，把这些简单的问题想明白了，再看代码时才不会迷糊。 IO流作用是什么？答：实现对文件的读写，这里的文件是广义的； Java如何实现程序到文件
No matching PlatformTransactionManager bean found for qualifier 'add' - neither 林鹤霄
java.lang.IllegalStateException: No matching PlatformTransactionManager bean found for qualifier 'add' - neither qualifier match nor bean name match! 网上找了好多的资料没能解决，后来发现：项目中使用的是xml配置的方式配置事务，但是
Row size too large (> 8126). Changing some columns to TEXT or BLOB aigo column
原文：http://stackoverflow.com/questions/15585602/change-limit-for-mysql-row-size-too-large 异常信息： Row size too large (> 8126). Changing some columns to TEXT or BLOB or using ROW_FORMAT=DYNAM
JS 格式化时间 alxw4616 JavaScript
/** * 格式化时间 2013/6/13 by 半仙 [email protected] * 需要 pad 函数 * 接收可用的时间值. * 返回替换时间占位符后的字符串 * * 时间占位符:年 Y 月 M 日 D 小时 h 分 m 秒 s 重复次数表示占位数 * 如 YYYY 4占4位 YY 占2位<p></p> * MM DD hh mm
队列中数据的移除问题百合不是茶队列移除
队列的移除一般都是使用的remov();都可以移除的,但是在昨天做线程移除的时候出现了点问题,没有将遍历出来的全部移除, 代码如下; // package com.Thread0715.com; import java.util.ArrayList; public class Threa
Runnable接口使用实例 bijian1013 java thread Runnable java多线程
Runnable接口 a. 该接口只有一个方法：public void run(); b. 实现该接口的类必须覆盖该run方法 c. 实现了Runnable接口的类并不具有任何天
oracle里的extend详解 bijian1013 oracle 数据库 extend
扩展已知的数组空间，例： DECLARE TYPE CourseList IS TABLE OF VARCHAR2(10); courses CourseList; BEGIN -- 初始化数组元素，大小为3 courses := CourseList('Biol 4412 ', 'Psyc 3112 ', 'Anth 3001 '); --
【httpclient】httpclient发送表单POST请求 bit1129 httpclient
浏览器Form Post请求浏览器可以通过提交表单的方式向服务器发起POST请求，这种形式的POST请求不同于一般的POST请求 1. 一般的POST请求，将请求数据放置于请求体中，服务器端以二进制流的方式读取数据，HttpServletRequest.getInputStream()。这种方式的请求可以处理任意数据形式的POST请求，比如请求数据是字符串或者是二进制数据 2. Form
【Hive十三】Hive读写Avro格式的数据 bit1129 hive
1. 原始数据 hive> select * from word; OK 1 MSN 10 QQ 100 Gtalk 1000 Skype 2. 创建avro格式的数据表 hive> CREATE TABLE avro_table(age INT, name STRING)STORE
nginx+lua+redis自动识别封解禁频繁访问IP ronin47
在站点遇到攻击且无明显攻击特征，造成站点访问慢，nginx不断返回502等错误时，可利用nginx+lua+redis实现在指定的时间段内，若单IP的请求量达到指定的数量后对该IP进行封禁，nginx返回403禁止访问。利用redis的expire命令设置封禁IP的过期时间达到在指定的封禁时间后实行自动解封的目的。一、安装环境： CentOS x64 release 6.4(Fin
java-二叉树的遍历-先序、中序、后序（递归和非递归）、层次遍历 bylijinnan java
import java.util.LinkedList; import java.util.List; import java.util.Stack; public class BinTreeTraverse { //private int[] array={ 1, 2, 3, 4, 5, 6, 7, 8, 9 }; private int[] array={ 10,6,
Spring源码学习-XML 配置方式的IoC容器启动过程分析 bylijinnan java spring IOC
以FileSystemXmlApplicationContext为例，把Spring IoC容器的初始化流程走一遍： ApplicationContext context = new FileSystemXmlApplicationContext ("C:/Users/ZARA/workspace/HelloSpring/src/Beans.xml&q
[科研与项目]民营企业请慎重参与军事科技工程 comsci 企业
军事科研工程和项目并非要用最先进，最时髦的技术，而是要做到“万无一失” 而民营科技企业在搞科技创新工程的时候，往往考虑的是技术的先进性，而对先进技术带来的风险考虑得不够，在今天提倡军民融合发展的大环境下，这种“万无一失”和“时髦性”的矛盾会日益凸显。。。。。。所以请大家在参与任何重大的军事和政府项目之前，对
spring 定时器-两种方式 cuityang spring quartz 定时器
方式一：间隔一定时间运行 <bean id="updateSessionIdTask" class="com.yang.iprms.common.UpdateSessionTask" autowire="byName" /> <bean id="updateSessionIdSchedule
简述一下关于BroadView站点的相关设计 damoqiongqiu view
终于弄上线了，累趴，戳这里http://www.broadview.com.cn 简述一下相关的技术点前端：jQuery+BootStrap3.2+HandleBars，全站Ajax（貌似对SEO的影响很大啊！怎么破？），用Grunt对全部JS做了压缩处理，对部分JS和CSS做了合并（模块间存在很多依赖，全部合并比较繁琐，待完善）。后端：U
运维 PHP问题汇总 dcj3sjt126com windows2003
1、Dede(织梦)发表文章时,内容自动添加关键字显示空白页解决方法：后台>系统>系统基本参数>核心设置>关键字替换（是/否），这里选择“是”。后台>系统>系统基本参数>其他选项>自动提取关键字，这里选择“是”。 2、解决PHP168超级管理员上传图片提示你的空间不足网站是用PHP168做的，反映使用管理员在后台无法
mac 下安装php扩展 - mcrypt dcj3sjt126com PHP
MCrypt是一个功能强大的加密算法扩展库，它包括有22种算法，phpMyAdmin依赖这个PHP扩展，具体如下：下载并解压libmcrypt-2.5.8.tar.gz。在终端执行如下命令： tar zxvf libmcrypt-2.5.8.tar.gz cd libmcrypt-2.5.8/ ./configure --disable-posix-threads --
MongoDB更新文档 [四] eksliang mongodb Mongodb更新文档
MongoDB更新文档转载请出自出处：http://eksliang.iteye.com/blog/2174104 MongoDB对文档的CURD，前面的博客简单介绍了，但是对文档更新篇幅比较大，所以这里单独拿出来。语法结构如下： db.collection.update( criteria, objNew, upsert, multi) 参数含义参数
Linux下的解压，移除，复制，查看tomcat命令 y806839048 tomcat
重复myeclipse生成webservice有问题删除以前的，干净 1、先切换到：cd usr/local/tomcat5/logs 2、tail -f catalina.out 3、这样运行时就可以实时查看运行日志了 Ctrl+c 是退出tail命令。有问题不明的先注掉 cp /opt/tomcat-6.0.44/webapps/g
Spring之使用事务缘由(3-XML实现) ihuning spring
用事务通知声明式地管理事务事务管理是一种横切关注点。为了在 Spring 2.x 中启用声明式事务管理，可以通过 tx Schema 中定义的 <tx:advice> 元素声明事务通知，为此必须事先将这个 Schema 定义添加到 <beans> 根元素中去。声明了事务通知后，就需要将它与切入点关联起来。由于事务通知是在 <aop:
GCD使用经验与技巧浅谈啸笑天 GC
前言 GCD(Grand Central Dispatch)可以说是Mac、iOS开发中的一大“利器”，本文就总结一些有关使用GCD的经验与技巧。 dispatch_once_t必须是全局或static变量这一条算是“老生常谈”了，但我认为还是有必要强调一次，毕竟非全局或非static的dispatch_once_t变量在使用时会导致非常不好排查的bug，正确的如下： 1
linux（Ubuntu）下常用命令备忘录1 macroli linux 工作 ubuntu
在使用下面的命令是可以通过--help来获取更多的信息1,查询当前目录文件列表：ls ls命令默认状态下将按首字母升序列出你当前文件夹下面的所有内容，但这样直接运行所得到的信息也是比较少的，通常它可以结合以下这些参数运行以查询更多的信息： ls / 显示/.下的所有文件和目录 ls -l 给出文件或者文件夹的详细信息 ls -a 显示所有文件，包括隐藏文
nodejs同步操作mysql qiaolevip 学习永无止境每天进步一点点 mysql nodejs
// db-util.js var mysql = require('mysql'); var pool = mysql.createPool({ connectionLimit : 10, host: 'localhost', user: 'root', password: '', database: 'test', port: 3306 });
一起学Hive系列文章 superlxw1234 hive Hive入门
[一起学Hive]系列文章目录贴，入门Hive，持续更新中。 [一起学Hive]之一—Hive概述，Hive是什么 [一起学Hive]之二—Hive函数大全-完整版 [一起学Hive]之三—Hive中的数据库(Database)和表(Table) [一起学Hive]之四-Hive的安装配置 [一起学Hive]之五-Hive的视图和分区 [一起学Hive
Spring开发利器：Spring Tool Suite 3.7.0 发布 wiselyman spring
Spring Tool Suite(简称STS)是基于Eclipse，专门针对Spring开发者提供大量的便捷功能的优秀开发工具。在3.7.0版本主要做了如下的更新：将eclipse版本更新至Eclipse Mars 4.5 GA Spring Boot(JavaEE开发的颠覆者集大成者，推荐大家学习)的配置语言YAML编辑器的支持(包含自动提示，