weixin_39983427

python预测未来数据步骤_大神教你用Python预测未来：一文看懂时间序列（值得收藏）...

导读：本文内容较长，较为详细的阐述了进行时间序列预测的步骤，有些内容可能暂时用不到或者看不懂，但不要紧，知道有这么一个概念，后续碰到的时候，继续深入学习以及使用就可以。

作者：Leandro Rabelo

译者：李洁

整理：Lemonbit

来源：Python数据之道(ID：PyDataRoad)

▲Photo by Adrian Schwarz on Unsplash

我们被随处可见的模式所包围，人们可以注意到四季与天气的关系模式，以交通量计算的交通高峰期的模式，你的心跳或者是股票市场和某些产品的销售周期。

分析时间序列数据对于发现这些模式和预测未来非常有用。有几种方法可以创建这类预测，在本文中，我将介绍最基本且最传统的方法概念。

所有代码都是用 Python 编写的，并且在 GitHub 上可以看到所有的信息。

https://nbviewer.jupyter.org/github/leandrovrabelo/tsmodels/blob/master/notebooks/english/Basic Principles for Time Series Forecasting.ipynb

那么让我们开始谈谈分析时间序列的初始条件：

01 平稳序列

平稳时间序列是指统计特性，如均值、方差和自相关系数，随时间相对恒定的序列。因此，非平稳序列是统计特性随时间变化的序列。在开始任何预测建模之前，都有必要验证这些统计属性是否是常量，我将一一解释下面的每个点：

常数均值

常数方差

自相关

1. 常数均值

一个平稳序列在时间上具有一个相对稳定的均值，这个值没有减少或者增加的趋势。围绕常数均值的小的变化，使我们更容易推测未来。在某些情况下，相对于平均值的变量比较小，使用它可以很好地预测未来。下图显示了变量与该常数平均值相对于时间变化的关系:

在这种情况下，如果序列不是平稳的，对未来的预测将是无效的，因为平均值周围的变量会显著偏离，如下图所示:

在上图中，我们可以明显看到上升的趋势，均值正在逐渐上升。在这种情况下，如果使用均值进行未来值的预测，误差将非常大，因为预测价格会总是低于实际价格。

2. 常数方差

当序列的方差为常数时，我们知道均值和标准差之间存在一种关系。当方差不为常数时(如下图所示)，预测在某些时期可能会有较大的误差，而这些时期是不可预测的。可以预测到，随着时间的推移直到未来，方差会保持不稳定。

为了减小方差效应，可以采用对数变换。在本例中，也可以使用指数变换，如 Box-Cox 方法，或者使用膨胀率调整。

3. 自相关序列

当两个变量在时间上的标准差有相似的变化时，你可以说这些变量是相关的。例如，体重会随着心脏疾病而增加，体重越大，心脏问题的发生率就越大。在这种情况下，相关性是正的，图形应该是这样的:

负相关的情况类似于这样：对工作安全措施的投入越多，工作相关的事故数量就越少。下面是几个相关级别的散点图的例子:

当谈到自相关时，意思是某些先前时期与当前时期存在相关性，这种相关性是滞后的。例如，在以小时为单位的测量值序列中，今天 12:00 的温度与 24 小时前的 12:00 的温度非常相似。如果你比较 24 小时内的温度变化，就会存在自相关，在本例中，我们将与第 24 小时前的时间存在自相关关系。

自相关是使用单个变量创建预测的一种情况，因为如果没有相关性，就不能使用过去的值来预测未来；当有多个变量时，则可以验证因变量和独立变量的滞后之间是否存在相关性。

如果一个序列不存在自相关关系，那么它就是随机且不可预测的，做预测的最佳方法通常是使用前一天的值。我将在下面使用更详细的图表来解释。

从这里开始我将分析 Esalq 上的每周含水乙醇价格(这是巴西谈判含水乙醇的价格参考)，数据可以在这里下载：

https://www.cepea.esalq.usp.br/br/indicador/etanol.aspx

价格单位是巴西雷亚尔每立方米(BRL/m3)。在开始任何分析之前，要将数据划分为训练集和测试集。

4. 划分训练集和测试集数据

当我们要创建时序预测模型时，将数据划分为两部分至关重要：

训练集：这些数据将是定义模型系数/参数的主要依据；

测试集：这些数据将被分离且对模型不可见，用于测试模型是否有效(通常将这些值与模型结果进行比较，最后测量平均误差)。

测试集的大小通常约为总样本的20%，尽管这个百分比取决于你拥有的样本大小以及你希望提前多少时间进行预测。理想情况下，测试集应至少与所需预测的最大范围相同。

与其他如分类和回归等不受时间影响的预测方法不同，在时间序列中，不可以将训练和测试数据从数据中随机抽样取出，我们必须遵循序列的时间标准，训练数据应该始终是在测试数据之前。

在本例中，我们有Esalq 含水乙醇的 856 周的价格数据，使用前 700 周的数据作为训练集，后 156 周(3年，18%)的数据用作测试集：

从现在开始，我们只使用训练集来做研究，测试集仅用于验证我们的预测。

每一个时间序列可以分为三个部分：趋势、季节性和残差，残差是将前两部分从序列中去除后剩下的部分，使用这种分割方法之后：

显然，该序列具有上升趋势，在每一年的年底到年初之间达到峰值，在4月和9月之间达到最低值(此时在巴西中南部开始甘蔗的压榨)。

我们仍然建议使用统计测试来确认序列是否是平稳的，这里将使用两个测试：Dickey-Fuller 测试和 KPSS 测试。

首先，我们将使用 Dickey-Fuller 检验，我将使用 5% 的基础 P 值，也就是说，如果 P 值低于 5% 这意味着这个序列在统计上是平稳的。

此外，还有模型的统计检验，可以将检验值与 1%、5%、10% 的临界值进行比较，如果统计检验低于选定的某个临界值，就认为序列是平稳的:

在本例中，Dickey-Fuller 检验结果表明序列不是平稳的( P 值 36%，临界值 5% 小于统计检验)。

现在我们要用 KPSS 检验分析序列，与 Dickey-Fuller 检验不同，KPSS 检验已经假设序列是平稳的，只有当 P 值小于 5% 或统计检验小于某个临界值时，序列才不是平稳的：

KPSS 检验证实了 Dickey-Fuller 检验的正确性，同时也表明该序列不是平稳的，因为 P 值为 1%，统计检验高于任何临界值。接下来，我将演示如何将序列转换为平稳状态。

02 将序列转换为平稳状态

1. 差分

差分法用来移除趋势信号，也可以用来减少方差，它只是 T 周期的值与前一个 T-1 周期值的差值。为了更容易理解，下面我们只用一小部分的乙醇价格，以便更好地可视化，可以看到从 2005 年 5 月开始价格上涨，直到 2006 年 5 月中旬，价格每周都在上涨，这就累积了一个上升的趋势，这种情况下，属于非平稳序列。

当进行一阶微分时(如下图)，我们去除了序列的累积效应，并且仅显示了整个系列中时段 T 相对于时段 T-1 的变化，因此如果 3 天前的价格为 800 BRL 且已涨到 850.00 BRL，差价将是 50.00 BRL，如果今天的价格是 860.00 BRL，那么差价将是 - 10.00 BRL。

通常只需要一阶微分就足够将序列转换为平稳状态，但如果需要，可以应用二阶微分，在这种情况下，将对一阶微分的值进行求导(几乎没有二阶以上微分的情况)。同样的例子，要进行二次微分，我们必须取 T 时刻减去 T-1 时刻的微分：2.9 BRL -5.5 BRL = - 2.6 BRL 等等。

我们来做一下 Dickey-Fuller 测试，看看这个序列是否会在一阶微分后是平稳的：

在这种情况下，我们确定该序列是平稳的，P 值为零，并且当我们比较统计检验的值时，它远远低于临界值。在下一个例子中，我们将尝试调整通货膨胀率将一个序列转换到平稳状态。

2. 膨胀率调整

价格是相对于交易时间的，2002 年乙醇的价格是 680.00 BRL，如果现在产品的价格是这个价格，很多工厂肯定会倒闭，因为这个价格非常低。为了让序列平稳，我将基于当前值使用巴西 IPCA 索引(巴西的 CPI 指数)调整整个序列，从训练区间的结尾(2016年4月)到研究的开始，数据的来源是 IBGE 网站。

现在我们来看序列如何能变平稳以及是否变平稳。

如图所示，上升趋势已经消失，只剩下季节性振荡， Dickey-Fuller 测试也证实了这个序列现在是稳定的。如果好奇，可以参阅下面的图表，其中调整后的价格与原始系列的通货膨胀率相对应。

3. 减小方差

对数变换

对数变换通常用于将指数增长的序列转换为具有更趋于线性增长的序列，在本例中，我们将使用自然对数(Natural Logarithm，NL)，其底数为 2.718 ，这种对数类型在经济模型中被广泛使用。

转换成 NL 值的差值近似等于原始序列值的百分比变化，作为降低不同价格序列的方差的基础是很有效的，如下例:

如果我们有一个产品在 2000 年价格上涨，从 50.00 BRL 到 52.50 BRL，几年后(2019年)，价格已经是 100.00 BRL，已经上涨到 105.00 BRL，价格之间的绝对差分别是 2.50 BRL 和 5.00 BRL，但两者的百分比差为 5% 。

当我们对这些价格中使用 NL 时，我们得到：NL (52.50) - NL(50.00) = 3.96 - 3.912 = 0.048 或 4.8%，同样地，在第二个价格序列中使用 LN 时，我们得到：NL (105) - NL(100) = 4.654-4.605 = 0.049 或 4.9% 。

在这个例子中，我们可以通过把几乎所有的东西都放到相同的基上来减少差异值。下面还是同一个例子:

price1 = np.log(52.5) - np.log(50)

price2 = np.log(105) - np.log(100)

printf('The percentage variation of the first example is {round(price1*100,1)} and the second is {round(price2*100,1)}')

原始序列与 NL 序列变换的对比图:

Box-Cox 变换(指数变换)

Box-Cox 转换也是一种转换序列的方法，lambda(λ)的值是用于转换序列的参数。

简而言之，这个函数是几个指数变换函数的结合，我们需要找到转换序列的 lambda 的最佳值，使其分布更接近正态高斯分布。使用此转换的一个条件是序列只有正值，公式为：

接下来我将绘制原始序列及其分布图，然后用 lambda 最佳值绘制新的转换序列及其分布图，为了找到 lambda 的值，我们将使用库 Scipy 的boxcox函数生成转换的序列和理想 lambda 值：

下面是一个交互式图表，在图中可以更改 lambda 值和检查更改：

此工具通常用于提高模型的性能，因为它使模型更趋于正态分布，记住在完成模型的预测后，必须根据以下公式反转转换到原始的基数：

4. 寻找相关时滞

为了便于预测，具有单一变量的序列必须具有自相关性，即，当前时段必须是能够基于较早的时段(滞后)而解释的。

由于这个序列每周为一周期，1 年大约 52 周，我将使用 60 的滞后期的自相关函数来验证当前周期与这些滞后的相关性。

通过对上述自相关图的分析，似乎所有的滞后都可以用来为未来事件创建预测，因为它们的正相关接近 1 ，而且都在置信区间之外，但这一特征属于非平稳序列。

另一个非常重要的函数是部分自相关函数，其中消除了先前的滞后对当前区间的影响，只保留了当前区间滞后的影响来分析，例如：第四个滞后的偏自相关将消除第一、第二和第三个滞后的影响。

部分自相关图如下：

可以看到，几乎没有滞后对当前周期有影响，但是正如前面所演示的，没有微分的序列不是平稳的，我们现在用一阶微分的序列绘制这两个函数来展示原理：

自相关曲线变化显著，表明该序列仅在第一个滞后期具有显著相关，在第 26 个滞后(半年)左右具有负相关的季节效应。

为了做出预测，我们必须注意一个找到相关的滞后现象的非常重要的细节，重要的是这种关联背后的原因，因为如果没有逻辑上的原因，就有可能是偶然的，当包含更多的数据时，这种关联就会消失。

另一个重点是自相关和部分自相关图对异常值非常敏感，因此分析时间序列本身并与两个自相关图进行对比非常重要。

在这个例子中，第一个滞后与当前周期具有高度相关性，因为前一周的价格历史上没有显著变化，在相同的情况下，第 26 个滞后呈现负相关，表明与当前时期相反的趋势，可能原因是一年内不同时期供需不同。

随着膨胀率调整后的序列已经趋于平稳，我们将使用它来创建我们的预测，下图是调整后序列的自相关和部分自相关图：

我们将只使用前两个滞后作为自回归序列的预测因子。

想要了解更多信息的话，杜克大学教授 Robert Nau 的网站是与此主题相关的最佳网站之一。

http://people.duke.edu/~rnau/411home.htm

03 模型评价指标

为了分析预测值是否接近当前值，必须对误差进行测量，此种情况下的误差(或残差)基本上是 Yreal-YpredYreal-Ypred (这个暂时不知道怎么翻译， real 真实值， pred 预测值)。

对训练数据中的错误进行评估以验证模型是否具有良好的确定性，然后通过检查测试数据中的误差(模型未“看到”的数据)来验证模型。

当将训练数据与测试数据进行对比时，检查误差对于验证你的模型是否过拟合或欠拟合非常重要。

以下是一些用于评估时间序列模型的关键指标：

1. 平均预测误差——偏差(bias)

它只是被评估序列的平均误差，值可以是正的也可以是负的。该指标表明，模型倾向于预测实际值以上(负误差)还是实际值以下(正误差)，因此也可以说平均预测误差是模型的偏差。

2. MAE——平均绝对误差

这个指标与上面提到的预测的平均误差非常相似，唯一的区别是将误差的负值转化为正值，然后计算平均值。

这个指标在时间序列中被广泛使用，因为在一些情况下，负误差可以抵消正误差，使人误以为模型是准确的，而在用 MAE 的情况下不会发生，因为这个指标显示预测距离实际值有多远，不管数值大还是小，示例如下：

a = np.array([1,2,3,4,5])

b = np.array([5,4,3,2,1])

error = a - b

MFE = error.mean()

MAE = np.abs(error).mean()

print(f'The error of each model value looks like this: {error}')

print(f'The MFE error was {MFE}, the MAE error was {MAE}')

与 MAE 和 MFE 不同，MSE 值是平方单位，而不是模型单位。

3. RMSE——均方根误差

这个指标只是 MSE 的平方根，使误差返回到模型的度量单位(BRL/m3)，因为它对时间序列在平方过程中产生的较大误差更为敏感而非常有用。

4. MAPE——平均绝对百分误差

这是另一个可用的有趣的指标，它通常在管理报告中使用，因为误差是以百分比度量的，所以产品 X 的错误可以与产品 Y 的误差进行比较。该指标的计算取误差的绝对值除以当前价格，然后计算平均值：

我们来创建一个函数，用几个评估指标来评估训练数据和测试数据的误差:

#Libraries to create the function:

from math import sqrt

from sklearn.metrics import mean_squared_error,mean_absolute_error, mean_absolute_error

def check_error(orig, pred, name_col='', index_name=''):

bias = np.mean(orig - pred)

mse = mean_squared_error(orig, pred)

rmse = sqrt(mean_squared_error(orig, pred))

mae = mean_absolute_error(orig, pred)

mape = np.mean(np.abs((orig - pred) / orig)) * 100

error_group = [bias, mse, rmse, mae, mape]

serie = pd.DataFrame(error_group, index=['BIAS','MSE','RMSE','MAE', 'MAPE'], columns=[name_col])

serie.index.name = index_name

return serie

残差与预测值(散点图)：

分析这个图是非常重要的，因为在这个图中我们可以检查模式，它可以告诉我们是否需要对模型进行一些修改，理想的情况是误差沿着预测序列线性分布。

残差的QQ图(散点图)：

https://en.wikipedia.org/wiki/Q–Q_plot

总的来说这是一个显示了残差在理论上应该如何分布的图形，遵循高斯分布，而不是实际情况。

残差自相关(序列图)：

如果没有置信区间的值，或者说模型不包含信息。

我们需要创建另一个函数来绘制这些图：

def plot_error(data, figsize=(18,8)):

# Creating the column error

data['Error'] = data.iloc[:,0] -data.iloc[:,1]

plt.figure(figsize=figsize)

ax1 = plt.subplot2grid((2,2), (0,0))

ax2 = plt.subplot2grid((2,2), (0,1))

ax3 = plt.subplot2grid((2,2), (1,0))

ax4 = plt.subplot2grid((2,2), (1,1))

#Plotting actual and predicted values

ax1.plot(data.iloc[:,0:2])

ax1.legend(['Real','Pred'])

ax1.set_title('Real Value vs Prediction')

# Error vs Predicted value

ax2.scatter(data.iloc[:,1], data.iloc[:,2])

ax2.set_xlabel('Predicted Values')

ax2.set_ylabel('Residual')

ax2.set_title('Residual vs Predicted Values')

## Residual QQ Plot

sm.graphics.qqplot(data.iloc[:,2], line='r', ax=ax3)

# Autocorrelation Plot of residual

plot_acf(data.iloc[:,2], lags=60, zero=False, ax=ax4)

plt.tight_layout()

plt.show()

与实际值相比，误差往往会增加。

许多人还使用这种方法作为基线(baseline)，试图用更复杂的模型来改进。

下面我们将使用训练数据和测试数据来进行模拟：

QQ 图显示了有一些比理论上要大些(包括正负值)的残差，这些是所谓的异常值，但在第一，第六和第七个滞后中仍然存在明显的自相关，这可以用于改进模型。

同样地，我们现在将在测试数据中进行预测。预测序列的第一个值将是训练数据的最后一个值，然后这些值将按照测试的当前值逐步更新，依此类推：

RMSE 和 MAE 的误差与训练数据相似，QQ 图与残差更符合理论值，可能是由于与训练数据相比样本值较少。

在对比残差与预测值的图表中，我们注意到当价格上涨时，误差绝对值有增加的趋势，可能用对数调整会减少误差的扩大并完成残差相关图，表明由于第一个滞后有很强的相关性，因此仍有改进的空间，可能添加基于第一个滞后的回归来改进预测。下一个模型是简单平均值：

5. 简单平均

另一种预测方法是使用序列平均值，通常当数值在平均值附近振荡时，具有常数的方差，没有上升或下降趋势时，这种预测形式是好的，但是也能使用更好的方法，其中可以使用季节模式进行预测。

此模型使用数据首端直到分析的前一个时期的平均值，并且按天扩展到数据结束，最后，趋势是一条直线，我们现在将此模型与第一个模型的误差进行比较：

在测试数据中，我将继续使用训练数据一开始的均值，并展开添加到测试数据上：

简单均值模型无法捕获序列的相关信息，如真实值和预测值图中所示，也可以在相关性和残差和预测图中看到。

简单滑动平均：

滑动平均是针对给定周期(例如 5 天)计算的平均值，它是滑动的并始终使用此特定时段进行计算，在这种情况下，我们将始终使用过去 5 天的平均值来预测下一天的值。

误差低于简单平均，但仍高于简单模型，以下是测试模型:

与训练数据相似，滑动平均模型优于简单平均模型，但尚未比简单模型基础有所增益。

预测具有 2 个时滞的自相关性，并且相对于预测值有很大的方差误差。

指数滑动平均:

上述简单滑动平均模型具有同等地处理最后 X 个观测值并完全忽略所有先前观测值的特性。直观地说，过去的数据应该逐渐打折，例如，理论上最近的观测结果应该比第二近的更重要，而第二近的观测应该比第三近的数据更重要，等等，指数滑动平均(Exponential Moving Average，EMM)模型就是这样做的。

由于 α(alpha)是一个常数，其值介于 0 和 1 之间，因此我们将使用以下公式计算预测值：

如果预测的第一个值是相应的当前值，其他值将更新为实际值与前一个时段的预测之差的 α 倍。当α为零时，我们根据第一个预测值得到一个常数，当 α 为 1 时，我们有一个简单方法的模型，因为结果是前一个实际周期的值。

下面是几个 α 值的图表：

EMM 预测中的平均数据周期为 1 /α。例如，当 α= 0.5 时，滞后相当于 2 个周期; 当 α= 0.2 时，滞后是 5 个周期; 当 α= 0.1 时，滞后是 10 个周期，依此类推。

在这个模型中，我们将任意选用 α 值为 0.5 ，而你可以通过网格搜索算法查找在训练集和验证集中都中减少了错误的 α，数据大概应是这样：

这个模型的误差与滑动平均的误差相似，但是我们需要在测试集对模型进行验证：

在验证数据中，目前为止的误差在我们已经训练过的模型中排名第二，而残差图的特征与 5 天滑动平均模型的特征非常相似。

6. 自回归

自回归模型基本上是一个具有显著相关滞后的线性回归，首先要绘制自相关图和部分自相关图来验证是否存在相关关系。

下面是训练序列的自相关图和部分自相关图，显示了自回归模型的特征为具有 2 个时滞的显著相关性:

接下来我们将根据训练数据创建模型，得到模型的系数后，将其乘以测试数据将要执行的值:

这个模型与我们所训练的其他模型相比，误差最小，现在我们用它的系数对训练数据进行逐步预测:

注意，在测试数据中，误差不会保持稳定，甚至会比简单模型更差，可以看到图中的预测值几乎总是低于当前值，偏差测量显示实际值比预测值高 50.19 BRL，也许在训练模型中调整一些参数，这种差异会减小。

要改进这些模型，你可以应用多个转换，例如本文中介绍的转换，也可以添加外部变量作为预测源，但是，这已然超出本文内容了。

04 结束语

每个时间序列模型都有自己的特点，应该分别单独分析，这样我们就可以提取尽可能多的信息来做出好的预测，减少未来的不确定性。

检验平稳度、转换数据、在训练数据中建立模型、验证测试数据、检验残差是建立良好时间序列预测的关键步骤。

也可以看看本文原作者的有关ARIMA模型的文章。

https://www.kaggle.com/leandrovrabelo/climate-change-forecast-sarima-model

原文：

https://towardsdatascience.com/basic-principles-to-create-a-time-series-forecast-6ae002d177a4

关于译者：李洁，北京师范大学香港浸会大学联合学院数据科学系助教，香港科技大学电信学硕士。

你可能感兴趣的:(python预测未来数据步骤)

机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
【iOS】MVC设计模式 Magnetic_h ios mvc 设计模式 objective-c 学习 ui
MVC前言如何设计一个程序的结构，这是一门专门的学问，叫做"架构模式"（architecturalpattern），属于编程的方法论。MVC模式就是架构模式的一种。它是Apple官方推荐的App开发架构，也是一般开发者最先遇到、最经典的架构。MVC各层controller层Controller/ViewController/VC（控制器）负责协调Model和View，处理大部分逻辑它将数据从Mod
10月|愿你的青春不负梦想-读书笔记-01 Tracy的小书斋
本书的作者是俞敏洪，大家都很熟悉他了吧。俞敏洪老师是我行业的领头羊吧，也是我事业上的偶像。本日摘录他书中第一章中的金句：『一个人如果什么目标都没有，就会浑浑噩噩，感觉生命中缺少能量。能给我们能量的，是对未来的期待。第一件事，我始终为了进步而努力。与其追寻全世界的骏马，不如种植丰美的草原，到时骏马自然会来。第二件事，我始终有阶段性的目标。什么东西能给我能量？答案是对未来的期待。』读到这里的时候，我便
微服务下功能权限与数据权限的设计与实现 nbsaas-boot 微服务 java 架构
在微服务架构下，系统的功能权限和数据权限控制显得尤为重要。随着系统规模的扩大和微服务数量的增加，如何保证不同用户和服务之间的访问权限准确、细粒度地控制，成为设计安全策略的关键。本文将讨论如何在微服务体系中设计和实现功能权限与数据权限控制。1.功能权限与数据权限的定义功能权限：指用户或系统角色对特定功能的访问权限。通常是某个用户角色能否执行某个操作，比如查看订单、创建订单、修改用户资料等。数据权限：
理解Gunicorn：Python WSGI服务器的基石范范0825 ipython linux 运维
理解Gunicorn：PythonWSGI服务器的基石介绍Gunicorn，全称GreenUnicorn，是一个为PythonWSGI（WebServerGatewayInterface）应用设计的高效、轻量级HTTP服务器。作为PythonWeb应用部署的常用工具，Gunicorn以其高性能和易用性著称。本文将介绍Gunicorn的基本概念、安装和配置，帮助初学者快速上手。1.什么是Gunico
c++ 的iostream 和 c++的stdio的区别和联系黄卷青灯77 c++算法开发语言 iostream stdio
在C++中，iostream和C语言的stdio.h都是用于处理输入输出的库，但它们在设计、用法和功能上有许多不同。以下是两者的区别和联系：区别1.编程风格iostream（C++风格）：C++标准库中的输入输出流类库，支持面向对象的输入输出操作。典型用法是cin（输入）和cout（输出），使用>操作符来处理数据。更加类型安全，支持用户自定义类型的输入输出。#includeintmain(){in
《投行人生》读书笔记小蘑菇的树洞
《投行人生》----作者詹姆斯-A-朗德摩根斯坦利副主席40年的职业洞见-很短小精悍的篇幅，比较适合初入职场的新人。第一部分成功的职业生涯需要规划1.情商归为适应能力分享与协作同理心适应能力，更多的是自我意识，你有能力识别自己的情并分辨这些情绪如何影响你的思想和行为。2.对于初入职场的人的建议，细节，截止日期和数据很重要截止日期，一种有效的方法是请老板为你所有的任务进行优先级排序。和老板喝咖啡的好
Long类型前后端数据不一致 igotyback 前端
响应给前端的数据浏览器控制台中response中看到的Long类型的数据是正常的到前端数据不一致前后端数据类型不匹配是一个常见问题，尤其是当后端使用Java的Long类型（64位）与前端JavaScript的Number类型（最大安全整数为2^53-1，即16位）进行数据交互时，很容易出现精度丢失的问题。这是因为JavaScript中的Number类型无法安全地表示超过16位的整数。为了解决这个问
Python数据分析与可视化实战指南 William数据分析 python python 数据
在数据驱动的时代，Python因其简洁的语法、强大的库生态系统以及活跃的社区，成为了数据分析与可视化的首选语言。本文将通过一个详细的案例，带领大家学习如何使用Python进行数据分析，并通过可视化来直观呈现分析结果。一、环境准备1.1安装必要库在开始数据分析和可视化之前，我们需要安装一些常用的库。主要包括pandas、numpy、matplotlib和seaborn等。这些库分别用于数据处理、数学
WPF中的ComboBox控件几种数据绑定的方式互联网打工人no1 wpf c#
一、用字典给ItemsSource赋值（此绑定用的地方很多，建议熟练掌握）在XMAL中：在CS文件中privatevoidBindData(){DictionarydicItem=newDictionary();dicItem.add(1,"北京");dicItem.add(2,"上海");dicItem.add(3,"广州");cmb_list.ItemsSource=dicItem;cmb_l
python os.environ 江湖偌大 python 深度学习
os.environ['TF_CPP_MIN_LOG_LEVEL']='0'#默认值，输出所有信息os.environ['TF_CPP_MIN_LOG_LEVEL']='1'#屏蔽通知信息（INFO）os.environ['TF_CPP_MIN_LOG_LEVEL']='2'#屏蔽通知信息和警告信息（INFO\WARNING）os.environ['TF_CPP_MIN_LOG_LEVEL']='
Python中os.environ基本介绍及使用方法鹤冲天Pro #Python python 服务器开发语言
文章目录python中os.environos.environ简介os.environ进行环境变量的增删改查python中os.environ的使用详解1.简介2.key字段详解2.1常见key字段3.os.environ.get()用法4.环境变量的增删改查和判断是否存在4.1新增环境变量4.2更新环境变量4.3获取环境变量4.4删除环境变量4.5判断环境变量是否存在python中os.envi
Pyecharts数据可视化大屏：打造沉浸式数据分析体验我的运维人生信息可视化数据分析数据挖掘运维开发技术共享
Pyecharts数据可视化大屏：打造沉浸式数据分析体验在当今这个数据驱动的时代，如何将海量数据以直观、生动的方式展现出来，成为了数据分析师和企业决策者关注的焦点。Pyecharts，作为一款基于Python的开源数据可视化库，凭借其丰富的图表类型、灵活的配置选项以及高度的定制化能力，成为了构建数据可视化大屏的理想选择。本文将深入探讨如何利用Pyecharts打造数据可视化大屏，并通过实际代码案例
2019-12-22-22:30 涓涓1016
今天是冬至，写下我的日更，是因为这两天的学习真的是能量的满满，让我看到了自己，未来另外一种可能性，也让我看到了这两年这几年的过程中我所接受那些痛苦的来源。一切的根源和痛苦都来自于人生，家庭，而你的原生家庭，你的爸爸和妈妈，是因为你这个灵魂在那一刻选择他们作为你的爸爸和妈妈来的，所以你得接受他，你得接纳他，他就是因为他的存在而给你的学习和成长带来这些痛苦，那其实是你必然要经历的这个过程，当你去接纳的
第四天旅游线路预览——从换乘中心到喀纳斯湖陟彼高冈yu 基于Google earth studio 的旅游规划和预览旅游
第四天：从贾登峪到喀纳斯风景区入口，晚上住宿贾登峪；换乘中心有4路车，喀纳斯①号车，去喀纳斯湖，路程时长约5分钟；将上面的的行程安排进行动态展示，具体步骤见”Googleearthstudio进行动态轨迹显示制作过程“、“Googleearthstudio入门教程”和“Googleearthstudio进阶教程“相关内容，得到行程如下所示：Day4-2-480p
linux sdl windows.h,Windows下的SDL安装奔跑吧linux内核 linux sdl windows.h
首先你要下载并安装SDL开发包。如果装在C盘下，路径为C:\SDL1.2.5如果在WINDOWS下。你可以按以下步骤：1.打开VC++，点击"Tools",Options2,点击directories选项3.选择"Includefiles"增加一个新的路径。"C:\SDL1.2.5\include"4，现在选择"Libaryfiles“增加"C:\SDL1.2.5\lib"现在你可以开始编写你的第
Python教程：一文了解使用Python处理XPath 旦莫 Python进阶 python 开发语言
目录1.环境准备1.1安装lxml1.2验证安装2.XPath基础2.1什么是XPath？2.2XPath语法2.3示例XML文档3.使用lxml解析XML3.1解析XML文档3.2查看解析结果4.XPath查询4.1基本路径查询4.2使用属性查询4.3查询多个节点5.XPath的高级用法5.1使用逻辑运算符5.2使用函数6.实战案例6.1从网页抓取数据6.1.1安装Requests库6.1.2代
Google earth studio 简介陟彼高冈yu 旅游
GoogleEarthStudio是一个基于Web的动画工具，专为创作使用GoogleEarth数据的动画和视频而设计。它利用了GoogleEarth强大的三维地图和卫星影像数据库，使用户能够轻松地创建逼真的地球动画、航拍视频和动态地图可视化。网址为https://www.google.com/earth/studio/。GoogleEarthStudio是一个基于Web的动画工具，专为创作使用G
python os.environ_python os.environ 读取和设置环境变量 weixin_39605414 python os.environ
>>>importos>>>os.environ.keys()['LC_NUMERIC','GOPATH','GOROOT','GOBIN','LESSOPEN','SSH_CLIENT','LOGNAME','USER','HOME','LC_PAPER','PATH','DISPLAY','LANG','TERM','SHELL','J2REDIR','LC_MONETARY','QT_QPA
linux中sdl的使用教程,sdl使用入门 Melissa Corvinus linux中sdl的使用教程
本文通过一个简单示例讲解SDL的基本使用流程。示例中展示一个窗口，窗口里面有个随机颜色快随机移动。当我们鼠标点击关闭按钮时间窗口关闭。基本步骤如下：1.初始化SDL并创建一个窗口。SDL_Init()初始化SDL_CreateWindow()创建窗口2.纹理渲染存储RGB和存储纹理的区别：比如一个从左到右由红色渐变到蓝色的矩形，用存储RGB的话就需要把矩形中每个点的具体颜色值存储下来；而纹理只是一
LLM 词汇表落难Coder LLMs NLP 大语言模型大模型 llama 人工智能
Contextwindow“上下文窗口”是指语言模型在生成新文本时能够回溯和参考的文本量。这不同于语言模型训练时所使用的大量数据集，而是代表了模型的“工作记忆”。较大的上下文窗口可以让模型理解和响应更复杂和更长的提示，而较小的上下文窗口可能会限制模型处理较长提示或在长时间对话中保持连贯性的能力。Fine-tuning微调是使用额外的数据进一步训练预训练语言模型的过程。这使得模型开始表示和模仿微调数
PHP环境搭建详细教程好看资源平台前端 php
PHP是一个流行的服务器端脚本语言，广泛用于Web开发。为了使PHP能够在本地或服务器上运行，我们需要搭建一个合适的PHP环境。本教程将结合最新资料，介绍在不同操作系统上搭建PHP开发环境的多种方法，包括Windows、macOS和Linux系统的安装步骤，以及本地和Docker环境的配置。1.PHP环境搭建概述PHP环境的搭建主要分为以下几类：集成开发环境：例如XAMPP、WAMP、MAMP，这
关于提高复杂业务逻辑代码可读性的思考编程经验分享开发经验 java 数据库开发语言
目录前言需求场景常规写法拆分方法领域对象总结前言实际工作中大部分时间都是在写业务逻辑，一般都是三层架构，表示层（Controller）接收客户端请求，并对入参做检验，业务逻辑层（Service）负责处理业务逻辑，一般开发都是在这一层中写具体的业务逻辑。数据访问层（Dao）是直接和数据库交互的，用于查数据给业务逻辑层，或者是将业务逻辑层处理后的数据写入数据库。简单的增删改查接口不用多说，基本上写好一
SQL Server_查询某一数据库中的所有表的内容 qq_42772833 SQL Server 数据库 sqlserver
1.查看所有表的表名要列出CrabFarmDB数据库中的所有表（名），可以使用以下SQL语句：USECrabFarmDB;--切换到目标数据库GOSELECTTABLE_NAMEFROMINFORMATION_SCHEMA.TABLESWHERETABLE_TYPE='BASETABLE';对这段SQL脚本的解释：SELECTTABLE_NAME：这个语句的作用是从查询结果中选择TABLE_NAM
2023-04-17|篮球女孩长一木
1小学抑或初中阶段，在课外书了解到她的故事。“篮球女孩”。当时佩服她的顽强，也对生命多了一丝敬畏。今天刚好在公众号看到，长大后的“篮球女孩”。佩服之余又满是心疼。网络侵删祝那素未蒙面的女孩，未来一切顺遂。
使用Faiss进行高效相似度搜索 llzwxh888 faiss python
在现代AI应用中，快速和高效的相似度搜索是至关重要的。Faiss（FacebookAISimilaritySearch）是一个专门用于快速相似度搜索和聚类的库，特别适用于高维向量。本文将介绍如何使用Faiss来进行相似度搜索，并结合Python代码演示其基本用法。什么是Faiss？Faiss是一个由FacebookAIResearch团队开发的开源库，主要用于高维向量的相似性搜索和聚类。Faiss
使用LLaVa和Ollama实现多模态RAG示例 llzwxh888 python 人工智能开发语言
本文将详细介绍如何使用LLaVa和Ollama实现多模态RAG（检索增强生成），通过提取图像中的结构化数据、生成图像字幕等功能来展示这一技术的强大之处。安装环境首先，您需要安装以下依赖包：!pipinstallllama-index-multi-modal-llms-ollama!pipinstallllama-index-readers-file!pipinstallunstructured!p
python是什么意思中文-在python中%是什么意思编程大乐趣
Python中%有两种：1、数值运算：%代表取模，返回除法的余数。如：>>>7%212、%操作符（字符串格式化，stringformatting），说明如下：%[(name)][flags][width].[precision]typecode(name)为命名flags可以有+，-，''或0。+表示右对齐。-表示左对齐。''为一个空格，表示在正数的左侧填充一个空格，从而与负数对齐。0表示使用0填
使用Apify加载Twitter消息以进行微调的完整指南 nseejrukjhad twitter easyui 前端 python
#使用Apify加载Twitter消息以进行微调的完整指南##引言在自然语言处理领域，微调模型以适应特定任务是提升模型性能的常见方法。本文将介绍如何使用Apify从Twitter导出聊天信息，以便进一步进行微调。##主要内容###使用Apify导出推文首先，我们需要从Twitter导出推文。Apify可以帮助我们做到这一点。通过Apify的强大功能，我们可以批量抓取和导出数据，适用于各类应用场景。
深入理解 MultiQueryRetriever：提升向量数据库检索效果的强大工具 nseejrukjhad 数据库 python
深入理解MultiQueryRetriever：提升向量数据库检索效果的强大工具引言在人工智能和自然语言处理领域，高效准确的信息检索一直是一个关键挑战。传统的基于距离的向量数据库检索方法虽然广泛应用，但仍存在一些局限性。本文将介绍一种创新的解决方案：MultiQueryRetriever，它通过自动生成多个查询视角来增强检索效果，提高结果的相关性和多样性。MultiQueryRetriever的工
html 周华华 html
js 1，数组的排列 var arr=[1,4,234,43,52,]; for(var x=0;x<arr.length;x++){ for(var y=x-1;y<arr.length;y++){ if(arr[x]<arr[y]){ &
【Struts2 四】Struts2拦截器 bit1129 struts2拦截器
Struts2框架是基于拦截器实现的，可以对某个Action进行拦截，然后某些逻辑处理，拦截器相当于AOP里面的环绕通知，即在Action方法的执行之前和之后根据需要添加相应的逻辑。事实上，即使struts.xml没有任何关于拦截器的配置，Struts2也会为我们添加一组默认的拦截器，最常见的是，请求参数自动绑定到Action对应的字段上。 Struts2中自定义拦截器的步骤是：
make:cc 命令未找到解决方法 daizj linux 命令未知 make cc
安装rz sz程序时，报下面错误： [root@slave2 src]# make posix cc -O -DPOSIX -DMD=2 rz.c -o rz make: cc：命令未找到 make: *** [posix] 错误 127 系统：centos 6.6 环境：虚拟机错误原因：系统未安装gcc，这个是由于在安
Oracle之Job应用周凡杨 oracle job
最近写服务，服务上线后，需要写一个定时执行的SQL脚本，清理并更新数据库表里的数据，应用到了Oracle 的 Job的相关知识。在此总结一下。一：查看相关job信息 1、相关视图 dba_jobs all_jobs user_jobs dba_jobs_running 包含正在运行
多线程机制朱辉辉33 多线程
转至http://blog.csdn.net/lj70024/archive/2010/04/06/5455790.aspx 程序、进程和线程：程序是一段静态的代码，它是应用程序执行的蓝本。进程是程序的一次动态执行过程，它对应了从代码加载、执行至执行完毕的一个完整过程，这个过程也是进程本身从产生、发展至消亡的过程。线程是比进程更小的单位，一个进程执行过程中可以产生多个线程，每个线程有自身的
web报表工具FineReport使用中遇到的常见报错及解决办法（一）老A不折腾 web报表 finereport java报表报表工具
FineReport使用中遇到的常见报错及解决办法（一）这里写点抛砖引玉，希望大家能把自己整理的问题及解决方法晾出来，Mark一下，利人利己。出现问题先搜一下文档上有没有，再看看度娘有没有，再看看论坛有没有。有报错要看日志。下面简单罗列下常见的问题，大多文档上都有提到的。 1、address pool is full：含义：地址池满，连接数超过并发数上
mysql rpm安装后没有my.cnf 林鹤霄没有my.cnf
Linux下用rpm包安装的MySQL是不会安装/etc/my.cnf文件的，至于为什么没有这个文件而MySQL却也能正常启动和作用，在这儿有两个说法，第一种说法，my.cnf只是MySQL启动时的一个参数文件，可以没有它，这时MySQL会用内置的默认参数启动，第二种说法，MySQL在启动时自动使用/usr/share/mysql目录下的my-medium.cnf文件，这种说法仅限于r
Kindle Fire HDX root并安装谷歌服务框架之后仍无法登陆谷歌账号的问题 aigo root
原文：http://kindlefireforkid.com/how-to-setup-a-google-account-on-amazon-fire-tablet/ Step 4: Run ADB command from your PC On the PC, you need install Amazon Fire ADB driver and instal
javascript 中var提升的典型实例 alxw4616 JavaScript
// 刚刚在书上看到的一个小问题,很有意思.大家一起思考下吧 myname = 'global'; var fn = function () { console.log(myname); // undefined var myname = 'local'; console.log(myname); // local }; fn() // 上述代码实际上等同于以下代码 m
定时器和获取时间的使用百合不是茶时间的转换定时器
定时器:定时创建任务在游戏设计的时候用的比较多 Timer();定时器 TImerTask();Timer的子类由 Timer 安排为一次执行或重复执行的任务。定时器类Timer在java.util包中。使用时，先实例化，然后使用实例的schedule(TimerTask task, long delay)方法，设定
JDK1.5 Queue bijian1013 java thread java多线程 Queue
JDK1.5 Queue LinkedList： LinkedList不是同步的。如果多个线程同时访问列表，而其中至少一个线程从结构上修改了该列表，则它必须保持外部同步。（结构修改指添加或删除一个或多个元素的任何操作；仅设置元素的值不是结构修改。）这一般通过对自然封装该列表的对象进行同步操作来完成。如果不存在这样的对象，则应该使用 Collections.synchronizedList 方
http认证原理和https bijian1013 http https
一.基础介绍在URL前加https://前缀表明是用SSL加密的。你的电脑与服务器之间收发的信息传输将更加安全。 Web服务器启用SSL需要获得一个服务器证书并将该证书与要使用SSL的服务器绑定。 http和https使用的是完全不同的连接方式，用的端口也不一样,前者是80，后
【Java范型五】范型继承 bit1129 java
定义如下一个抽象的范型类，其中定义了两个范型参数，T1，T2 package com.tom.lang.generics; public abstract class SuperGenerics<T1, T2> { private T1 t1; private T2 t2; public abstract void doIt(T
【Nginx六】nginx.conf常用指令(Directive) bit1129 Directive
1. worker_processes 8; 表示Nginx将启动8个工作者进程，通过ps -ef|grep nginx,会发现有8个Nginx Worker Process在运行 nobody 53879 118449 0 Apr22 ? 00:26:15 nginx: worker process
lua 遍历Header头部 ronin47 lua header 遍历　
local headers = ngx.req.get_headers() ngx.say("headers begin", "<br/>") ngx.say("Host : ", he
java-32.通过交换a,b中的元素，使[序列a元素的和]与[序列b元素的和]之间的差最小(两数组的差最小)。 bylijinnan java
import java.util.Arrays; public class MinSumASumB { /** * Q32.有两个序列a,b，大小都为n,序列元素的值任意整数，无序. * * 要求：通过交换a,b中的元素，使[序列a元素的和]与[序列b元素的和]之间的差最小。 * 例如: * int[] a = {100,99,98,1,2,3
redis 开窍的石头 redis
在redis的redis.conf配置文件中找到# requirepass foobared 把它替换成requirepass 12356789 后边的12356789就是你的密码打开redis客户端输入config get requirepass 返回 redis 127.0.0.1:6379> config get requirepass 1) "require
[JAVA图像与图形]现有的GPU架构支持JAVA语言吗？ comsci java语言
无论是opengl还是cuda，都是建立在C语言体系架构基础上的，在未来，图像图形处理业务快速发展，相关领域市场不断扩大的情况下，我们JAVA语言系统怎么从这么庞大，且还在不断扩大的市场上分到一块蛋糕，是值得每个JAVAER认真思考和行动的事情
安装ubuntu14.04登录后花屏了怎么办 cuiyadll ubuntu
这个情况，一般属于显卡驱动问题。可以先尝试安装显卡的官方闭源驱动。按键盘三个键：CTRL + ALT + F1 进入终端，输入用户名和密码登录终端：安装amd的显卡驱动 sudo apt-get install fglrx 安装nvidia显卡驱动 sudo ap
SSL 与数字证书的基本概念和工作原理 darrenzhu 加密 ssl 证书密钥签名
SSL 与数字证书的基本概念和工作原理 http://www.linuxde.net/2012/03/8301.html SSL握手协议的目的是或最终结果是让客户端和服务器拥有一个共同的密钥，握手协议本身是基于非对称加密机制的，之后就使用共同的密钥基于对称加密机制进行信息交换。 http://www.ibm.com/developerworks/cn/webspher
Ubuntu设置ip的步骤 dcj3sjt126com ubuntu
在单位的一台机器完全装了Ubuntu Server，但回家只能在XP上VM一个，装的时候网卡是DHCP的，用ifconfig查了一下ip是192.168.92.128,可以ping通。转载不是错： Ubuntu命令行修改网络配置方法 /etc/network/interfaces打开后里面可设置DHCP或手动设置静态ip。前面auto eth0，让网卡开机自动挂载. 1. 以D
php包管理工具推荐 dcj3sjt126com PHP Composer
http://www.phpcomposer.com/ Composer是 PHP 用来管理依赖（dependency）关系的工具。你可以在自己的项目中声明所依赖的外部工具库（libraries），Composer 会帮你安装这些依赖的库文件。中文文档入门指南下载安装包列表 Composer 中国镜像
Gson使用四（TypeAdapter） eksliang json gson Gson自定义转换器 gsonTypeAdapter
转载请出自出处：http://eksliang.iteye.com/blog/2175595 一.概述 Gson的TypeAapter可以理解成自定义序列化和返序列化二、应用场景举例例如我们通常去注册时（那些外国网站），会让我们输入firstName，lastName,但是转到我们都
JQM控件之Navbar和Tabs gundumw100 html xml css
在JQM中使用导航栏Navbar是简单的。只需要将data-role="navbar"赋给div即可： <div data-role="navbar"> <ul> <li><a href="#" class="ui-btn-active&qu
利用归并排序算法对大文件进行排序 iwindyforest java 归并排序大文件分治法 Merge sort
归并排序算法介绍，请参照Wikipeida zh.wikipedia.org/wiki/%E5%BD%92%E5%B9%B6%E6%8E%92%E5%BA%8F 基本思想：大文件分割成行数相等的两个子文件，递归（归并排序）两个子文件，直到递归到分割成的子文件低于限制行数低于限制行数的子文件直接排序两个排序好的子文件归并到父文件直到最后所有排序好的父文件归并到输入
iOS UIWebView URL拦截啸笑天 UIWebView
本文译者：candeladiao，原文：URL filtering for UIWebView on the iPhone说明：译者在做app开发时，因为页面的javascript文件比较大导致加载速度很慢，所以想把javascript文件打包在app里，当UIWebView需要加载该脚本时就从app本地读取，但UIWebView并不支持加载本地资源。最后从下文中找到了解决方法，第一次翻译，难免有
索引的碎片整理SQL语句 macroli sql
SET NOCOUNT ON DECLARE @tablename VARCHAR (128) DECLARE @execstr VARCHAR (255) DECLARE @objectid INT DECLARE @indexid INT DECLARE @frag DECIMAL DECLARE @maxfrag DECIMAL --设置最大允许的碎片数量,超过则对索引进行碎片
Angularjs同步操作http请求with $promise qiaolevip 每天进步一点点学习永无止境 AngularJS 纵观千象
// Define a factory app.factory('profilePromise', ['$q', 'AccountService', function($q, AccountService) { var deferred = $q.defer(); AccountService.getProfile().then(function(res) {
hibernate联合查询问题 sxj19881213 sql Hibernate HQL 联合查询
最近在用hibernate做项目，遇到了联合查询的问题，以及联合查询中的N+1问题。针对无外键关联的联合查询，我做了HQL和SQL的实验，希望能帮助到大家。（我使用的版本是hibernate3.3.2） 1 几个常识：（1）hql中的几种join查询，只有在外键关联、并且作了相应配置时才能使用。（2）hql的默认查询策略，在进行联合查询时，会产
struts2.xml wuai struts
<?xml version="1.0" encoding="UTF-8" ?> <!DOCTYPE struts PUBLIC "-//Apache Software Foundation//DTD Struts Configuration 2.3//EN" "http://struts.apache