Y学习使我快乐V

AdaBoost基本原理与算法描述

一. 前言

最近在看集成学习方法，前面已经对XGBoost的原理与简单实践做了介绍，这次对AdaBoost算法做个学习笔记，来巩固自己所学的知识，同时也希望对需要帮助的人有所帮助。

关于集成学习主要有两大分支，一种是bagging方法，一种是boosting方法。

bagging方法的弱学习器之间没有依赖关系，各个学习器可以并行生成，最终通过某种策略进行集成得到强学习器（比如回归问题用所有弱学习器输出值的平均值作为预测值；分类问题使用投票法，即少数服从多数的方法来得到最终的预测值；也可以使用学习法，即每个弱学习器的输出值作为训练数据来重新学习一个学习器，而该学习器的输出值作为最终的预测值，代表方法有stacking方法，感兴趣的同学可以自己去了解一下）。bagging方法采用自助采样法，即在总样本中随机的选取m个样本点作为样本m1，然后放回，继续随机选取m个样本点作为样本m2，如此循环下去直到选取的样本个数达到预设定值n，对这n个样本进行学习，生成n个弱学习器。随机森林算法就是bagging方法的代表算法。

boosting方法的若学习器之间有强的依赖关系，各个弱学习器之间串行生成。它的工作机制是初始给每个样本赋予一个权重值（初始权重值一般是1/m，m表示有m个样本），然后训练第一个弱学习器，根据该弱学习器的学习误差率来更新权重值，使得该学习器中的误差率高的训练样本点（所有的训练样本点）的权重值变高，权重值高的训练样本点在后面的弱学习器中会得到更多的重视，以此方法来依次学习各个弱学习器，直到弱学习器的数量达到预先指定的值为止，最后通过某种策略将这些弱学习器进行整合，得到最终的强学习器。boosting方法的代表算法有AdaBoost和boosting tree算法，而AdaBoost算法就是本文接下来要介绍的算法。

在介绍AdaBoost之前，要先搞清楚boosting系列算法主要解决的一些问题，如下：

弱学习器的权重系数 $\alpha$ 如何计算？
样本点的权重系数如何更新？
学习的误差率如何计算？
最后使用的结合策略是什么？

下面我们就来看看AdaBoost是如何解决以上问题的。

二. AdaBoost基本原理介绍

2.1 AdaBoost分类问题

以二分类为例，假设给定一个二类分类的训练数据集 $\chi = \left \{ (x_{1}, y_{1}), (x_{2}, y_{2}),...,(x_{n}, y_{n})\right \}$ ，其中 $x_{i}$ 表示样本点， $y_{i}$ 表示样本对应的类别，其可取值为｛-1，1｝。AdaBoost算法利用如下的算法，从训练数据中串行的学习一系列的弱学习器，并将这些弱学习器线性组合为一个强学习器。AdaBoost算法描述如下：

输入：训练数据集 $\chi = \left \{ (x_{1}, y_{1}), (x_{2}, y_{2}),...,(x_{n}, y_{n})\right \}$

输出：最终的强分类器G(x)

(1) 初始化训练数据的权重分布值：（ $D_{m}$ 表示第m个弱学习器的样本点的权值）

$D_{1}=(w_{11},...,w_{1i},...,w_{1N}),$ $w_{1i}=1/N,$

(2) 对M个弱学习器，m=1，2，...，M：

（a）使用具有权值分布 $D{_{m}}$ 的训练数据集进行学习，得到基本分类器 $G{_{m}}(x)$ ，其输出值为｛-1，1｝；

（b）计算弱分类器 $G{_{m}}(x)$ 在训练数据集上的分类误差率 $e{_{m}}$ ，其值越小的基分类器在最终分类器中的作用越大。

其中， $I(G{_{m}}(x{_{i}})\neq y{_{i}})$ 取值为0或1，取0表示分类正确，取1表示分类错误。

（c）计算弱分类器 $G{_{m}}(x)$ 的权重系数 $\alpha {_{m}}$ ：（这里的对数是自然对数）

$\alpha {_{m}}=\frac{1}{2}ln{\frac{1-e{_{m}}}{e{_{m}}}}$

一般情况下 $e{_{m}}$ 的取值应该小于0.5，因为若不进行学习随机分类的话，由于是二分类错误率等于0.5，当进行学习的时候，错误率应该略低于0.5。当 $e{_{m}}$ 减小的时候 $\alpha {_{m}}$ 的值增大，而我们希望得到的是分类误差率越小的弱分类器的权值越大，对最终的预测产生的影响也就越大，所以将弱分类器的权值设为该方程式从直观上来说是合理地，具体的证明 $\alpha {_{m}}$ 为上式请继续往下读。

（d）更新训练数据集的样本权值分布：

对于二分类，弱分类器 $G{_{m}}(x)$ 的输出值取值为｛-1，1｝， $y{_{i}}$ 的取值为｛-1，1｝，所以对于正确的分类 $y{_{i}}G{_{m}}(x)>0$ ，对于错误的分类 $y{_{i}}G{_{m}}(x)<0$ ，由于样本权重值在[0，1]之间，当分类正确时 $w{_{m+1,i}}$ 取值较小，而分类错误时 $w{_{m+1,i}}$ 取值较大，而我们希望得到的是权重值高的训练样本点在后面的弱学习器中会得到更多的重视，所以该上式从直观上感觉也是合理地，具体怎样合理，请往下读。

其中， $Z{_{m}}$ 是规范化因子，主要作用是将 $W{_{mi}}$ 的值规范到0-1之间，使得 $\sum_{i=1}^{N}{W{_{mi}}} = 1$ 。

(3) 上面我们介绍了弱学习器的权重系数α如何计算，样本的权重系数W如何更新，学习的误差率e如何计算，接下来是最后一个问题，各个弱学习器采用何种结合策略了，AdaBoost对于分类问题的结合策略是加权平均法。如下，利用加权平均法构建基本分类器的线性组合：

$f(x)=\sum_{m=1}^{M}{\alpha {_{m}}G{_{m}}(x)}$

得到最终的分类器：

$G(x)=sign(f(x))=sign(\sum_{m=1}^{M}\alpha {_{m}}G{_{m}}(x))$

以上就是对于AdaBoost分类问题的介绍，接下来是对AdaBoost的回归问题的介绍。

2.2 AdaBoost回归问题

AdaBoost回归问题有许多变种，这里我们以AdaBoost R2算法为准。

（1）我们先看看回归问题的误差率问题，对于第m个弱学习器，计算他在训练集上的最大误差：

$E{_{m}}=max|y{_{i}}-G{_{m}}(x{_{i}})|$

然后计算每个样本的相对误差：（计算相对误差的目的是将误差规范化到[0，1]之间）

$e{_{mi}}=\frac{|y{_{i}}-G{_{m}}(x{_{i}})|}{E{_{m}}}$ ，显然 $0\leq e{_{mi}}\leq 1$

这里是误差损失为线性时的情况，如果我们用平方误差，则 $e{_{mi}}=\frac{|y{_{i}}-G{_{m}}(x{_{i}})|}{E{_{m}}^2}^2$ ，如果我们用指数误差，则 $e{_{mi}}=1-exp(\frac{-y{_{i}}+G{_{m}}(x{_{i}})}{E{_{m}}})$

最终得到第k个弱学习器的误差率为：

$e{_{m}}=\sum_{i=1}^{N}{w{_{mi}}e{_{mi}}}$ ，表示每个样本点的加权误差的总和即为该弱学习器的误差。

（2）我们再来看看弱学习器的权重系数α，如下公式：

$\alpha {_{m}}=\frac{e{_{m}}}{1-e{_{m}}}$

（3）对于如何更新回归问题的样本权重，第k+1个弱学习器的样本权重系数为：

$w{_{m+i,i}}=\frac{w{_{mi}}}{Z{_{m}}}\alpha {_{m}}^{1-e{_{mi}}}$

其中 $Z{_{k}}$ 是规范化因子： $Z{_{m}}=\sum_{i=1}^{N}{w{_{mi}}\alpha {_{m}}^{1-e{_{mi}}}}$

（4）最后是结合策略，和分类问题不同，回归问题的结合策略采用的是对加权弱学习器取中位数的方法，最终的强回归器为：

$G(x)=\sum_{m=1}^{M}{g(x)ln\frac{1}{\alpha {_{m}}}}$ ，其中是所有 $\alpha {_{m}}G{_{m}}(x)$ 的中位数（m=1，2，...，M）。

这就是AdaBoost回归问题的算法介绍，还有一个问题没有解决，就是在分类问题中我们的弱学习器的权重系数 $\alpha {_{m}}$ 是如何通过计算严格的推导出来的。

2.3 AdaBoost前向分步算法

在上两节中，我们介绍了AdaBoost的分类与回归问题，但是在分类问题中还有一个没有解决的就是弱学习器的权重系数 $\alpha {_{m}}=\frac{1}{2}ln{\frac{1-e{_{m}}}{e{_{m}}}}$ 是如何通过公式推导出来的。这里主要用到的就是前向分步算法，接下来我们就介绍该算法。

从另一个角度讲，AdaBoost算法是模型为加法模型，损失函数为指数函数，学习算法为前向分步算法时的分类问题。其中，加法模型表示我们的最终得到的强分类器是若干个弱分类器加权平均得到的，如下：

$f(x)=\sum_{m=1}^{M}{\alpha {_{m}}G{_{m}}(x)}$

损失函数是指数函数，如下：

学习算法为前向分步算法，下面就来介绍AdaBoost是如何利用前向分布算法进行学习的：

（1）假设进过m-1轮迭代前向分布算法已经得到 $f{_{m-1}}(x)$ ：

$f{_{m-1}}=f{_{m-2}}(x)+\alpha {_{m-1}}G{_{m-1}}(x)$

$=\alpha {_{1}}G{_{1}}(x)+...+\alpha {_{m-1}}G{_{m-1}}(x)$

在第m轮的迭代得到 $\alpha {_{m}}$ ， $G{_{m}}(x)$ 和 $f{_{m}}(x)$ .

$f{_{m}}(x)=f{_{m-1}}(x)+\alpha {_{m}}G{_{m}}(x)$

目标是使前向分布算法得到的 $\alpha {_{m}}$ 和 $G{_{m}}(x)$ 使 $f{_{m}}(x)$ 在训练数据集T上的指数损失最小，即

$(\alpha {_{m}},G{_{m}}(x))=arg \underset{\alpha ,G}{min}\sum_{i=1}^{N}exp(-y{_{i}}(f{_{m-1}}(x{_{i}})+\alpha G(x{_{i}})))$

$=arg\underset{\alpha ,G}{min}\sum_{i=1}^{N}\bar{w}{_{mi}}exp(-y{_{i}}\alpha G(x{_{i}}))$ ${\color{Red} (1)}$

上式即为我们利用前向分步学习算法得到的损失函数。其中， $\bar{w}{_{mi}}=exp(-y{_{i}}f{_{m-1}}(x{_{i}}))$ 。因为 $\bar{w}{_{mi}}$ 既不依赖 $\alpha$ 也不依赖于G，所以在第m轮迭代中与最小化无关。但 $\bar{w}{_{mi}}$ 依赖于 $f{_{m-1}}(x)$ ，随着每一轮的迭代而发生变化。

上式达到最小时所取的 $\alpha ^{_{*}}{_{m}}$ 和 $G ^{_{*}}{_{m}}(x)$ 就是AdaBoost算法所得到的 $\alpha {_{m}}$ 和 $G{_{m}}(x)$ 。

（2）首先求分类器 $G ^{_{*}}{_{m}}(x)$ ：

我们知道，对于二分类的分类器G(x)的输出值为-1和1， $y{_{i}}\neq G{_{m}}(x{_{i}})$ 表示预测错误， $y{_{i}}= G{_{m}}(x{_{i}})$ 表示正确，每个样本点都有一个权重值，所以对于一个弱分类器的输出则为： $G{_{m}}(x)=\sum_{i=1}^{N}\bar{w}{_{mi}}I(y{_{i}}\neq G{_{m}}(X{_{i}}))$ ，我们的目标是使损失最小化，所以我们的具有损失最小化的第m个弱分类器即为：

$G^{_{*}}{_{m}}(x)=arg \underset{G}{min}\sum_{i=1}^{N}\bar{w}{_{mi}}I(y{_{i}}\neq G(x{_{i}}))$ 其中， $\bar{w}{_{mi}}=exp(-y{_{i}}f{_{m-1}}(x{_{i}}))$

为什么用 $I(y{_{i}}\neq G(x{_{i}}))$ 表示一个弱分类器的输出呢？因为我们的AdaBoost并没有限制弱学习器的种类，所以它的实际表达式要根据使用的弱学习器类型来定。

此分类器即为Adaboost算法的基本分类器 $G{_{m}}(x)$ ，因为它是使第m轮加权训练数据分类误差率最小的基本分类器。

（3）然后就是来求 $\alpha ^{_{*}}{_{m}}$ ，

将 $G ^{_{*}}{_{m}}(x)$ 代入损失函数（1）式中，得：

$\alpha {_{m}}=\sum_{i=1}^{N}\bar{w}{_{mi}}exp(-y{_{i}}\alpha{_{m}} G^{_{*}}{_{m}}(x{_{i}}))$

我们的目标是最小化上式，求出对应的 $\alpha ^{_{*}}{_{m}}$ 。

$\sum_{i=1}^{N}\bar{w}{_{mi}}exp(-y{_{i}}\alpha{_{m}} G^{_{*}}{_{m}}(x{_{i}}))$

$=\sum_{y{_{i}}=G{_{m}}(x{_{i}})}\bar{w{_{mi}}}e^{_{-\alpha }}+\sum_{y{_{i}}\neq G{_{m}}(x{_{i}})}\bar{w{_{mi}}}e^{_{\alpha }}$

$=e^{_{-\alpha }}\sum_{y{_{i}}=G{_{m}}(x{_{i}})}\bar{w}{_{mi}}+e^{_{\alpha }}\sum_{y{_{i}}\neq G{_{m}}(x{_{i}})}\bar{w}{_{mi}}$

$=e^{_{-\alpha }}(\sum_{i=1}^{N}\bar{w}{_{mi}}-\sum_{y{_{i}}\neq G{_{m}}(x{_{i}})}\bar{w}{_{mi}})+e^{_{\alpha }}\sum_{y{_{i}}\neq G{_{m}}(x{_{i}})}\bar{w}{_{mi}}$

$=(e^{_{\alpha }}-e^{_{-\alpha }})\sum_{y{_{i}}\neq G{_{m}}(x{_{i}})}\bar{w}{_{mi}}+e^{_{-\alpha }}\sum_{i=1}^{N}\bar{w}{_{mi}}$

$=(e^{_{\alpha }}-e^{_{-\alpha }})\sum_{i=1}^{N}\bar{w}{_{mi}}I(y{_{i}}\neq G{_{m}}(x{_{i}}))+e^{_{-\alpha }}\sum_{i=1}^{N}\bar{w}{_{mi}}$ ${\color{Red} (2)}$

由于， $e{_{m}}=\frac{\sum_{i=1}^{N}\bar{w}{_{mi}}I(y{_{i}}\neq G{_{m}}(x{_{i}}))}{\sum_{i=1}^{N}\bar{w}{_{mi}}}$

注意：这里我们的样本点权重系数 $\bar{w}{_{mi}}$ 并没有进行规范化，所以 $\sum_{i=1}^{m}\bar{w}{_{mi}}\neq 1$

（2）式为： $(e^{_{\alpha }}-e^{_{-\alpha }})e{_{m}}\sum_{i=1}^{N}\bar{w}{_{mi}}+e^{_{-\alpha }}\sum_{i=1}^{N}\bar{w}{_{mi}}$

则我们的目标是求：

$\alpha {_{m}}=arg\underset{\alpha }{min}(e^{_{\alpha }}-e^{_{-\alpha }})e{_{m}}\sum_{i=1}^{N}\bar{w}{_{mi}}+e^{_{-\alpha }}\sum_{i=1}^{N}\bar{w}{_{mi}}$

上式求 $\alpha$ 偏导，并令偏导等于0，得：

$(e^{_{\alpha }}+e^{_{-\alpha }})e{_{m}}\sum_{i=1}^{N}\bar{w}{_{mi}}-e^{_{-\alpha }}\sum_{i=1}^{N}\bar{w}{_{mi}}=0$ ，进而得到：

$(e^{_{\alpha }}+e^{_{-\alpha }})e{_{m}}-e^{_{-\alpha }}=0$ ，求得： $\alpha ^{_{*}}{_{m}}=\frac{1}{2}ln\frac{1-e{_{m}}}{e{_{m}}}$ ，其中 $e{_{m}}$ 为误差率:

$e{_{m}}=\frac{\sum_{i=1}^{N}\bar{w}{_{mi}}I(y{_{i}}\neq G{_{m}}(x{_{i}}))}{\sum_{i=1}^{N}\bar{w}{_{mi}}}=\sum_{i=1}^{N}w{_{mi}}I(y{_{i}}\neq G(x{_{i}}))$

（4）最后看样本权重的更新。

利用前面所讲的 $f{_{m}}(x)=f{_{m-1}}(x)+\alpha {_{m}}G{_{m}}(x)$ ，以及权值 $\bar{w}{_{mi}}=exp(-y{_{i}}f{_{m-1}}(x))$

可以得到如下式子：

$\bar{w}{_{m+1,i}}=\bar{w}{_{mi}}exp(-y{_{i}}\alpha {_{m}}G{_{m}}(x{_{i}}))$

这样就得到了我们前面所讲的样本权重更新公式。

2.4 AdoBoost算法的正则化

为了防止过拟合，AdaBoost算法中也会加入正则化项，这个正则化项我们称之为步长也就是学习率。定义为v，对于前面的弱学习器的迭代有：

$f{_{m}}(x)=f{_{m-1}}(x)+\alpha {_{m}}G{_{m}}(x)$

加入正则化项，就变成如下：

$f{_{m}}(x)=f{_{m-1}}(x)+v\alpha {_{m}}G{_{m}}(x)$

v的取值范围为(0，1]。对于同样的训练集学习效果，较小的v意味着我们需要更多的弱学习器的迭代次数。通常我们用学习率和迭代最大次数一起来决定算法的拟合效果。

到这里，我们的AdaBoost算法介绍完毕。

三. AdaBoost算法流程描述

3.1 AdaBoost分类问题的算法流程描述

关于AdaBoost的分类问题，sklearn中采用的是SAMME和SAMME.R算法，SAMME.R算法是SAMME算法的变种。sklearn中默认采用SAMME.R，原因是SAMME.R算法比SAMME算法收敛速度更快，用更少的提升迭代次数实现了更低的测试误差。接下来我们先介绍AdaBoost的分类算法流程，可以将二元分类算法视为多元分类算法的一个特例。

3.1.1 SAMME算法流程描述：

输入：样本集 $T=\left \{ (x{_{1}},y{_{1}}),(x{_{2}},y{_{2}}),...,(x{_{N}},y{_{N}}) \right \}$ ，输出为 $\left \{ -1,1 \right \}$ ，弱分类器的迭代次数为M，样本点的个数为N。

输出：最终的强分类器

（1）初始化样本点的权重为：

$D_{1}=(w_{11},...,w_{1i},...,w_{1N}),$ $w_{1i}=1/N,$

（2）对于m=1,2,..,M

（a）使用带有权重的样本来训练一个弱学习器 $G{_{m}}(x)$ ;

（b）计算弱分类器 $G{_{m}}(x)$ 的分类误差率：

（c）计算弱分类器的系数：

$\alpha {_{m}}=\frac{1}{2}ln{\frac{1-e{_{m}}}{e{_{m}}}}+ln(K-1)$ ，

其中，K表示K元分类，可以看出当K=2时，，余下的 $\alpha {_{m}}$ 与我们二元分类算法所描述的弱分类器系数一致。

（d）更新样本的权重分布：

（3）构建最终的强分类器：

$G(x)=sign(f(x))=sign(\sum_{m=1}^{M}\alpha {_{m}}G{_{m}}(x))$

3.1.2 SAMME.R算法流程描述：

输出：最终的强分类器

（1）初始化样本点的权重为：

$D_{1}=(w_{11},...,w_{1i},...,w_{1N}),$ $w_{1i}=1/N,$

（2）对于m=1,2,..,M

（a）使用带有权重的样本来训练一个弱学习器 $G{_{m}}(x)$ ;

（b）获得带有权重分类的概率评估：

$P{_{mk}}(x{_{i}})=Prob{_{w}}(c=k|x{_{i}})$ ，

其中 $P{_{mk}}(x{_{i}})$ 表示第m个弱学习器将样本 $x{_{i}}$ 分为第k类的概率。k=1，2，...，K，K表示分类的类别个数。

（c）使用加权概率推导出加法模型的更新，然后将其应用于数据：

$h{_{mk}}(x)=(K-1)(logP{_{mk}}(x)-\frac{1}{K}\sum_{\bar{k}=1}^{K}logP{_{m\bar{k}}}(x))$ ，

（d）更新样本点权重系数：

$w{_{m+1,i}}=w{_{mi}}exp(-\frac{K-1}{K}y{_{i}}logP{_{m}}(x{_{i}}))$

（e）标准化样本点权重;

（3）构建最终的强分类器：

$G(x)=sign(arg\underset{K}{max}\sum_{m=1}^{M}h{_{mk}}(x))$ ，表示使 $\sum_{m=1}^{M}h{_{mk}}(x))$ 最大的类别即为我们所预测的类别。

3.2 AdaBoost回归问题的算法流程描述

在sklearn中，回归使用的算法为 AdaBoost.R2算法，具体的流程描述如下：

输出：最终的强分类器

（1）初始化样本点的权重为：

$D_{1}=(w_{11},...,w_{1i},...,w_{1N}),$ $w_{1i}=1/N,$

（2）对于m=1,2,..,M

（a）使用具有权重 $D{_{m}}$ 的样本集来训练数据，得到弱学习器 $G{_{m}}(x)$

（b）计算训练集上的最大误差

$E{_{k}}=max|y{_{i}}-G{_{m}}(x{_{i}})|$ ，

（c）计算每个样本点的相对误差：

如果是线性误差：则 $e{_{mi}}=\frac{|y{_{i}}-G{_{m}}(x{_{i}})|}{E{_{m}}}$

如果是平方误差，则 $e{_{mi}}=\frac{(y{_{i}}-G{_{m}}(x{_{i}}))^2}{E{_{m}}^2}$

如果是指数误差，则 $e{_{mi}}=1-exp(\frac{-|y{_{i}}-G{_{m}}(x{_{i}})|}{E{_{m}}})$

（d）计算回归误差率：

$e{_{m}}=\sum_{i=1}^{N}w{_{mi}}e{_{mi}}$

（c）计算弱学习器的系数：

$\alpha {_{m}}=\frac{e{_{m}}}{1-e{_{m}}}$

（d）更新样本集的权重分布：

$w{_{m+1,i}}=\frac{w{_{mi}}}{Z{_{m}}}\alpha {_{m}}^{1-e{_{mi}}}$ ，其中 $Z{_{m}}$ 是规范化因子， $Z{_{m}}=\sum_{i=1}^{N}w{_{mi}}\alpha {_{m}}^{1-e{_{mi}}}$

（3）构建最终的强学习器：

$G(x)=\sum_{m=1}^{M}{g(x)ln\frac{1}{\alpha {_{m}}}}$ ，其中是所有 $\alpha {_{m}}G{_{m}}(x)$ 的中位数（m=1，2，...，M）。

四. AdaBoost算法的优缺点

4.1 优点

（1）不容易发生过拟合；

（2）由于AdaBoost并没有限制弱学习器的种类，所以可以使用不同的学习算法来构建弱分类器；

（3）AdaBoost具有很高的精度；

（4）相对于bagging算法和Random Forest算法，AdaBoost充分考虑的每个分类器的权重；

（5）AdaBoost的参数少，实际应用中不需要调节太多的参数。

4.2 缺点

（1）AdaBoost迭代次数也就是弱分类器数目不太好设定，可以使用交叉验证来进行确定。

（2）数据不平衡导致分类精度下降。

（3）训练比较耗时，每次重新选择当前分类器最好切分点。

（4）对异常样本敏感，异常样本在迭代中可能会获得较高的权重，影响最终的强学习器的预测准确性。

五. 参考文献/博文

（1）李航，《统计学习方法》第八章

（2）Multi-class AdaBoost 论文

（3）Boosting for Regression Transfer AdaBoost回归论文

（4）https://www.cnblogs.com/pinard/p/6133937.html

机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
数字里的世界17期：2021年全球10大顶级数据中心，中国移动榜首张三叨
你知道吗？2016年，全球的数据中心共计用电4160亿千瓦时，比整个英国的发电量还多40％！前言每天，我们都会创造超过250万TB的数据。并且随着物联网（IOT）的不断普及，这一数据将持续增长。如此庞大的数据被存储在被称为“数据中心”的专用设施中。虽然最早的数据中心建于20世纪40年代，但直到1997-2000年的互联网泡沫期间才逐渐成为主流。当前人类的技术，比如人工智能和机器学习，已经将我们推向
nosql数据库技术与应用知识点皆过客，揽星河 NoSQL nosql 数据库大数据数据分析数据结构非关系型数据库
Nosql知识回顾大数据处理流程数据采集(flume、爬虫、传感器)数据存储(本门课程NoSQL所处的阶段)Hdfs、MongoDB、HBase等数据清洗(入仓)Hive等数据处理、分析(Spark、Flink等)数据可视化数据挖掘、机器学习应用(Python、SparkMLlib等)大数据时代存储的挑战(三高)高并发(同一时间很多人访问)高扩展(要求随时根据需求扩展存储)高效率(要求读写速度快)
Python开发常用的三方模块如下：换个网名有点难 python 开发语言
Python是一门功能强大的编程语言，拥有丰富的第三方库，这些库为开发者提供了极大的便利。以下是100个常用的Python库，涵盖了多个领域：1、NumPy，用于科学计算的基础库。2、Pandas，提供数据结构和数据分析工具。3、Matplotlib，一个绘图库。4、Scikit-learn，机器学习库。5、SciPy，用于数学、科学和工程的库。6、TensorFlow，由Google开发的开源机
Python实现简单的机器学习算法 master_chenchengg python python 办公效率 python开发 IT
Python实现简单的机器学习算法开篇：初探机器学习的奇妙之旅搭建环境：一切从安装开始必备工具箱第一步：安装Anaconda和JupyterNotebook小贴士：如何配置Python环境变量算法初体验：从零开始的Python机器学习线性回归：让数据说话数据准备：从哪里找数据编码实战：Python实现线性回归模型评估：如何判断模型好坏逻辑回归：从分类开始理论入门：什么是逻辑回归代码实现：使用skl
遥感影像的切片处理 sand&wich 计算机视觉 python 图像处理
在遥感影像分析中，经常需要将大尺寸的影像切分成小片段，以便于进行详细的分析和处理。这种方法特别适用于机器学习和图像处理任务，如对象检测、图像分类等。以下是如何使用Python和OpenCV库来实现这一过程，同时确保每个影像片段保留正确的地理信息。准备环境首先，确保安装了必要的Python库，包括numpy、opencv-python和xml.etree.ElementTree。这些库将用于图像处理
ai绘画工具midjourney怎么下载？附作品管理教程设计师早上好
Midjourney是一款功能强大的AI绘画工具，它使用机器学习技术和深度神经网络等算法，可以生成各种艺术风格的绘画作品。在创意设计、广告宣传等方面有着广泛的应用前景。那么，ai绘画工具midjourney怎么下载？本文将为您介绍Midjourney的下载以及作品的相关管理。一、Midjourney下载Midjourney的下载非常简单，只需打开Midjourney官网（点击“GetMidjour
[实践应用] 深度学习之模型性能评估指标 YuanDaima2048 深度学习工具使用深度学习人工智能损失函数性能评估 pytorch python 机器学习
文章总览：YuanDaiMa2048博客文章总览深度学习之模型性能评估指标分类任务回归任务排序任务聚类任务生成任务其他介绍在机器学习和深度学习领域，评估模型性能是一项至关重要的任务。不同的学习任务需要不同的性能指标来衡量模型的有效性。以下是对一些常见任务及其相应的性能评估指标的详细解释和总结。分类任务分类任务是指模型需要将输入数据分配到预定义的类别或标签中。以下是分类任务中常用的性能指标：准确率(
机器学习-聚类算法不良人龍木木机器学习机器学习算法聚类
机器学习-聚类算法1.AHC2.K-means3.SC4.MCL仅个人笔记，感谢点赞关注！1.AHC2.K-means3.SC传统谱聚类：个人对谱聚类算法的理解以及改进4.MCL目前仅专注于NLP的技术学习和分享感谢大家的关注与支持！
未来软件市场是怎么样的？做开发的生存空间如何？ cesske 软件需求
目录前言一、未来软件市场的发展趋势二、软件开发人员的生存空间前言未来软件市场是怎么样的？做开发的生存空间如何？一、未来软件市场的发展趋势技术趋势：人工智能与机器学习：随着技术的不断成熟，人工智能将在更多领域得到应用，如智能客服、自动驾驶、智能制造等，这将极大地推动软件市场的增长。云计算与大数据：云计算服务将继续普及，大数据技术的应用也将更加广泛。企业将更加依赖云计算和大数据来优化运营、提升效率，并
python中zeros用法_Python中的numpy.zeros()用法江平舟 python中zeros用法
numpy.zeros()函数是最重要的函数之一,广泛用于机器学习程序中。此函数用于生成包含零的数组。numpy.zeros()函数提供给定形状和类型的新数组,并用零填充。句法numpy.zeros(shape,dtype=float,order='C'参数形状：整数或整数元组此参数用于定义数组的尺寸。此参数用于我们要在其中创建数组的形状,例如(3,2)或2。dtype：数据类型(可选)此参数用于
【NumPy】深入解析numpy.zeros()函数二七830 numpy
欢迎莅临我的个人主页这里是我深耕Python编程、机器学习和自然语言处理（NLP）领域，并乐于分享知识与经验的小天地！博主简介：我是二七830，一名对技术充满热情的探索者。多年的Python编程和机器学习实践，使我深入理解了这些技术的核心原理，并能够在实际项目中灵活应用。尤其是在NLP领域，我积累了丰富的经验，能够处理各种复杂的自然语言任务。技术专长：我熟练掌握Python编程语言，并深入研究了机
【中国国际航空-注册_登录安全分析报告】风控牛验证码接口安全评测系列安全行为验证极验网易易盾智能手机
前言由于网站注册入口容易被黑客攻击，存在如下安全问题：1.暴力破解密码，造成用户信息泄露2.短信盗刷的安全问题，影响业务及导致用户投诉3.带来经济损失，尤其是后付费客户，风险巨大，造成亏损无底洞所以大部分网站及App都采取图形验证码或滑动验证码等交互解决方案，但在机器学习能力提高的当下，连百度这样的大厂都遭受攻击导致点名批评，图形验证及交互验证方式的安全性到底如何？请看具体分析一、中国国际航空PC
机器学习流形数据降维：UMAP 降维算法小嗷犬 Python 机器学习 #数据分析及可视化机器学习算法人工智能
✅作者简介：人工智能专业本科在读，喜欢计算机与编程，写博客记录自己的学习历程。个人主页：小嗷犬的个人主页个人网站：小嗷犬的技术小站个人信条：为天地立心，为生民立命，为往圣继绝学，为万世开太平。本文目录UMAP简介理论基础特点与优势应用场景在Python中使用UMAP安装umap-learn库使用UMAP可视化手写数字数据集UMAP简介UMAP（UniformManifoldApproximatio
七.正则化愿风去了
吴恩达机器学习之正则化（Regularization）http://www.cnblogs.com/jianxinzhou/p/4083921.html从数学公式上理解L1和L2https://blog.csdn.net/b876144622/article/details/81276818虽然在线性回归中加入基函数会使模型更加灵活，但是很容易引起数据的过拟合。例如将数据投影到30维的基函数上，模
机器学习-------数据标准化罔闻_spider 数据分析算法机器学习人工智能
什么是归一化，它与标准化的区别是什么？一作用在做训练时，需要先将特征值与标签标准化，可以防止梯度防炸和过拟合；将标签标准化后，网络预测出的数据是符合标准正态分布的—StandarScaler()，与真实值有很大差别。因为StandarScaler()对数据的处理是（真实值-平均值）/标准差。同时在做预测时需要将输出数据逆标准化提升模型精度：标准化/归一化使不同维度的特征在数值上更具比较性，提高分类
分享一个基于python的电子书数据采集与可视化分析 hadoop电子书数据分析与推荐系统 spark大数据毕设项目（源码、调试、LW、开题、PPT) 计算机源码社 Python项目大数据大数据 python hadoop 计算机毕业设计选题计算机毕业设计源码数据分析 spark毕设
作者：计算机源码社个人简介：本人八年开发经验，擅长Java、Python、PHP、.NET、Node.js、Android、微信小程序、爬虫、大数据、机器学习等，大家有这一块的问题可以一起交流！学习资料、程序开发、技术解答、文档报告如需要源码，可以扫取文章下方二维码联系咨询Java项目微信小程序项目Android项目Python项目PHP项目ASP.NET项目Node.js项目选题推荐项目实战|p
两种方法判断Python的位数是32位还是64位 sanqima Python编程电脑 python 开发语言
Python从1991年发布以来，凭借其简洁、清晰、易读的语法、丰富的标准库和第三方工具，在Web开发、自动化测试、人工智能、图形识别、机器学习等领域发展迅猛。 Python是一种胶水语言，通过Cython库与C/C++语言进行链接，通过Jython库与Java语言进行链接。 Python是跨平台的，可运行在多种操作系统上，包括但不限于Windows、Linux和macOS。这意味着用Py
使用最大边际相关性(MMR)选择示例：提高AI模型的多样性和相关性 aehrutktrjk 人工智能 easyui 前端 python
使用最大边际相关性(MMR)选择示例：提高AI模型的多样性和相关性引言在机器学习和自然语言处理领域，选择合适的训练示例对模型性能至关重要。最大边际相关性(MaximalMarginalRelevance,MMR)是一种优秀的示例选择方法，它不仅考虑了示例与输入的相关性，还注重保持所选示例之间的多样性。本文将深入探讨如何使用MMR来选择示例，以提高AI模型的性能和泛化能力。什么是最大边际相关性(MM
LangChain集成指南:如何利用多样化的AI提供商 aehrutktrjk 人工智能 langchain python
LangChain集成指南:如何利用多样化的AI提供商引言在人工智能和机器学习领域,LangChain已成为一个强大而灵活的框架,允许开发者轻松集成各种AI服务提供商。本文将深入探讨LangChain的集成能力,介绍如何利用不同的AI提供商来增强你的应用程序,并提供实用的代码示例。LangChain集成概览LangChain支持多种AI提供商的集成,这些集成可以分为两类:独立包集成:这些提供商有独
机器学习VS深度学习 nfgo 机器学习
机器学习（MachineLearning,ML）和深度学习（DeepLearning,DL）是人工智能（AI）的两个子领域，它们有许多相似之处，但在技术实现和应用范围上也有显著区别。下面从几个方面对两者进行区分：1.概念层面机器学习：是让计算机通过算法从数据中自动学习和改进的技术。它依赖于手动设计的特征和数学模型来进行学习，常用的模型有决策树、支持向量机、线性回归等。深度学习：是机器学习的一个子领
大数据毕业设计hadoop+spark+hive知识图谱租房数据分析可视化大屏租房推荐系统 58同城租房爬虫房源推荐系统房价预测系统计算机毕业设计机器学习深度学习人工智能 2401_84572577 程序员大数据 hadoop 人工智能
做了那么多年开发，自学了很多门编程语言，我很明白学习资源对于学一门新语言的重要性，这些年也收藏了不少的Python干货，对我来说这些东西确实已经用不到了，但对于准备自学Python的人来说，或许它就是一个宝藏，可以给你省去很多的时间和精力。别在网上瞎学了，我最近也做了一些资源的更新，只要你是我的粉丝，这期福利你都可拿走。我先来介绍一下这些东西怎么用，文末抱走。（1）Python所有方向的学习路线（
【机器学习与R语言】1-机器学习简介苹果酱0567 面试题汇总与解析 java 中间件开发语言 spring boot 后端
1.基本概念机器学习：发明算法将数据转化为智能行为数据挖掘VS机器学习：前者侧重寻找有价值的信息，后者侧重执行已知的任务。后者是前者的先期准备过程：数据——>抽象化——>一般化。或者：收集数据——推理数据——归纳数据——发现规律抽象化：训练：用一个特定模型来拟合数据集的过程用方程来拟合观测的数据：观测现象——数据呈现——模型建立。通过不同的格式来把信息概念化一般化：一般化：将抽象化的知识转换成可用
Python前沿技术：机器学习与人工智能 4.0啊 Python 人工智能 python 机器学习
Python前沿技术：机器学习与人工智能一、引言随着科技的飞速发展，机器学习和人工智能（AI）已经成为了计算机科学领域的热门话题。Python作为一门易学易用且功能强大的编程语言，已经成为了这两个领域的首选语言之一。本文将深入探讨Python在机器学习和人工智能领域的应用，以及一些前沿技术和工具。二、Python机器学习基础2.1机器学习概述机器学习是人工智能（AI）的一个关键子集，它的核心在于让
chatgpt赋能python：如何在Python中计算平均值 tulingtest ChatGpt python chatgpt numpy 计算机
如何在Python中计算平均值计算平均值是数据分析、统计和机器学习等许多领域中的常见任务。Python作为一门功能强大且易于学习的编程语言，为计算平均值提供了多种方法。在本文中，我们将介绍如何在Python中计算平均值。什么是平均值简单来说，平均值是一组数字的总和除以数字的数量。例如，对于数字序列1，3，5，7，9，平均值是(1+3+5+7+9)/5=5。平均值在数据分析中非常有用，因为它可以提供
Python 初学者入门必知： Anaconda是什么？有什么作用？怎么使用？懒大王爱吃狼 Python基础 python 开发语言 python基础 python学习 anaconda anaconda安装 python教程
初学者在学习Python时，经常看到的一个名字是Anaconda。究竟什么是Anaconda，为什么它如此受欢迎？在这篇文章中，我们将探讨Anaconda，了解Anaconda的从安装到使用的。Anaconda是一个免费开源的Python和R编程发行版，包含上千个适用于数据科学和机器学习的包。同时，配备了Spyder和Jupyternotebook等工具，初学者可以使用它们来学习Python，使用
每天五分钟玩转深度学习PyTorch：模型参数优化器torch.optim 幻风_huanfeng 深度学习框架pytorch 深度学习 pytorch 人工智能神经网络机器学习优化算法
本文重点在机器学习或者深度学习中，我们需要通过修改参数使得损失函数最小化(或最大化)，优化算法就是一种调整模型参数更新的策略。在pytorch中定义了优化器optim，我们可以使用它调用封装好的优化算法，然后传递给它神经网络模型参数，就可以对模型进行优化。本文是学习第6步(优化器)，参考链接pytorch的学习路线随机梯度下降算法在深度学习和机器学习中，梯度下降算法是最常用的参数更新方法，它的公式
一切皆是映射：AI的去中心化：区块链技术的融合 AI大模型应用之禅计算科学神经计算深度学习神经网络大数据人工智能大型语言模型 AI AGI LLM Java Python 架构设计 Agent RPA
一切皆是映射：AI的去中心化：区块链技术的融合作者：禅与计算机程序设计艺术/ZenandtheArtofComputerProgramming关键词：AI，区块链，去中心化，智能合约，共识机制，数据安全，隐私保护，分布式账本技术，机器学习，数据隐私1.背景介绍1.1问题的由来随着人工智能（AI）技术的快速发展，其在各个领域的应用越来越广泛，从自动驾驶、智能医疗到金融服务，AI正在改变着我们的生活。
第五届核磁机器学习班（训练营：2023.6.5~6.17）茗创科技
茗创科技专注于脑科学数据处理，涵盖（EEG/ERP,fMRI,结构像,DTI,ASL,FNIRS）等，欢迎留言讨论及转发推荐，也欢迎了解茗创科技的脑电课程，数据处理服务及脑科学工作站销售业务，可添加我们的工程师（微信号MCKJ-zhouyi或17373158786）咨询。★课程简介★基于血氧水平依赖的功能磁共振成像(fMRI)技术,利用其数据构建的功能性脑网络后,发现脑并不是一个单纯对外界刺激进行
如何有效的学习AI大模型？ Python程序员罗宾学习人工智能语言模型自然语言处理架构
学习AI大模型是一个系统性的过程，涉及到多个学科的知识。以下是一些建议，帮助你更有效地学习AI大模型：基础知识储备：数学基础：学习线性代数、概率论、统计学和微积分等，这些是理解机器学习算法的数学基础。编程技能：掌握至少一种编程语言，如Python，因为大多数AI模型都是用Python实现的。理论学习：机器学习基础：了解监督学习、非监督学习、强化学习等基本概念。深度学习：学习神经网络的基本结构，如卷
eclipse maven IXHONG eclipse
eclipse中使用maven插件的时候，运行run as maven build的时候报错 -Dmaven.multiModuleProjectDirectory system propery is not set. Check $M2_HOME environment variable and mvn script match. 可以设一个环境变量M2_HOME指
timer cancel方法的一个小实例 alleni123 多线程 timer
package com.lj.timer; import java.util.Date; import java.util.Timer; import java.util.TimerTask; public class MyTimer extends TimerTask { private int a; private Timer timer; pub
MySQL数据库在Linux下的安装 ducklsl mysql
1.建好一个专门放置MySQL的目录 /mysql/db数据库目录 /mysql/data数据库数据文件目录 2.配置用户，添加专门的MySQL管理用户 >groupadd mysql ----添加用户组 >useradd -g mysql mysql ----在mysql用户组中添加一个mysql用户 3.配置，生成并安装MySQL >cmake -D
spring------>>cvc-elt.1: Cannot find the declaration of element Array_06 spring bean
将-------- <?xml version="1.0" encoding="UTF-8"?> <beans xmlns="http://www.springframework.org/schema/beans" xmlns:xsi="http://www.w3
maven发布第三方jar的一些问题 cugfy maven
maven中发布第三方jar到nexus仓库使用的是 deploy:deploy-file命令有许多参数，具体可查看 http://maven.apache.org/plugins/maven-deploy-plugin/deploy-file-mojo.html 以下是一个例子： mvn deploy:deploy-file -DgroupId=xpp3
MYSQL下载及安装 357029540 mysql
好久没有去安装过MYSQL，今天自己在安装完MYSQL过后用navicat for mysql去厕测试链接的时候出现了10061的问题，因为的的MYSQL是最新版本为5.6.24，所以下载的文件夹里没有my.ini文件，所以在网上找了很多方法还是没有找到怎么解决问题，最后看到了一篇百度经验里有这个的介绍，按照其步骤也完成了安装，在这里给大家分享下这个链接的地址
ios TableView cell的布局张亚雄 tableview
cell.imageView.image = [UIImage imageNamed:[imageArray objectAtIndex:[indexPath row]]]; CGSize itemSize = CGSizeMake(60, 50); &nbs
Java编码转义 adminjun java 编码转义
import java.io.UnsupportedEncodingException; /** * 转换字符串的编码 */ public class ChangeCharset { /** 7位ASCII字符，也叫作ISO646-US、Unicode字符集的基本拉丁块 */ public static final Strin
Tomcat 配置和spring aijuans spring
简介 Tomcat启动时，先找系统变量CATALINA_BASE，如果没有，则找CATALINA_HOME。然后找这个变量所指的目录下的conf文件夹，从中读取配置文件。最重要的配置文件：server.xml 。要配置tomcat，基本上了解server.xml，context.xml和web.xml。 Server.xml -- tomcat主
Java打印当前目录下的所有子目录和文件 ayaoxinchao 递归 File
其实这个没啥技术含量，大湿们不要操笑哦，只是做一个简单的记录，简单用了一下递归算法。 import java.io.File; /** * @author Perlin * @date 2014-6-30 */ public class PrintDirectory { public static void printDirectory(File f
linux安装mysql出现libs报冲突解决 BigBird2012 linux
linux安装mysql出现libs报冲突解决安装mysql出现 file /usr/share/mysql/ukrainian/errmsg.sys from install of MySQL-server-5.5.33-1.linux2.6.i386 conflicts with file from package mysql-libs-5.1.61-4.el6.i686
jedis连接池使用实例 bijian1013 redis jedis连接池 jedis
实例代码： package com.bijian.study; import java.util.ArrayList; import java.util.List; import redis.clients.jedis.Jedis; import redis.clients.jedis.JedisPool; import redis.clients.jedis.JedisPoo
关于朋友 bingyingao 朋友兴趣爱好维持
成为朋友的必要条件：志相同，道不合，可以成为朋友。譬如马云、周星驰一个是商人，一个是影星，可谓道不同，但都很有梦想，都要在各自领域里做到最好，当他们遇到一起，互相欣赏，可以畅谈两个小时。志不同，道相合，也可以成为朋友。譬如有时候看到两个一个成绩很好每次考试争做第一，一个成绩很差的同学是好朋友。他们志向不相同，但他
【Spark七十九】Spark RDD API一 bit1129 spark
aggregate package spark.examples.rddapi import org.apache.spark.{SparkConf, SparkContext} //测试RDD的aggregate方法 object AggregateTest { def main(args: Array[String]) { val conf = new Spar
ktap 0.1 released bookjovi kernel tracing
Dear, I'm pleased to announce that ktap release v0.1, this is the first official release of ktap project, it is expected that this release is not fully functional or very stable and we welcome bu
能保存Properties文件注释的Properties工具类 BrokenDreams properties
今天遇到一个小需求：由于java.util.Properties读取属性文件时会忽略注释，当写回去的时候，注释都没了。恰好一个项目中的配置文件会在部署后被某个Java程序修改一下，但修改了之后注释全没了，可能会给以后的参数调整带来困难。所以要解决这个问题。 &nb
读《研磨设计模式》-代码笔记-外观模式-Facade bylijinnan java 设计模式
声明：本文只为方便我个人查阅和理解，详细的分析以及源代码请移步原作者的博客http://chjavach.iteye.com/ /* * 百度百科的定义： * Facade（外观）模式为子系统中的各类（或结构与方法）提供一个简明一致的界面， * 隐藏子系统的复杂性，使子系统更加容易使用。他是为子系统中的一组接口所提供的一个一致的界面 * * 可简单地
After Effects教程收集 cherishLC After Effects
1、中文入门 http://study.163.com/course/courseMain.htm?courseId=730009 2、videocopilot英文入门教程（中文字幕） http://www.youku.com/playlist_show/id_17893193.html 英文原址： http://www.videocopilot.net/basic/ 素
Linux Apache 安装过程 crabdave apache
Linux Apache 安装过程下载新版本： apr-1.4.2.tar.gz（下载网站：http://apr.apache.org/download.cgi） apr-util-1.3.9.tar.gz（下载网站：http://apr.apache.org/download.cgi） httpd-2.2.15.tar.gz（下载网站：http://httpd.apac
Shell学习之变量赋值和引用 daizj shell 变量引用赋值
本文转自：http://www.cnblogs.com/papam/articles/1548679.html Shell编程中，使用变量无需事先声明，同时变量名的命名须遵循如下规则：首个字符必须为字母（a-z，A-Z）中间不能有空格，可以使用下划线（_）不能使用标点符号不能使用bash里的关键字（可用help命令查看保留关键字）需要给变量赋值时，可以这么写：
Java SE 第一讲（Java SE入门、JDK的下载与安装、第一个Java程序、Java程序的编译与执行） dcj3sjt126com java jdk
Java SE 第一讲： Java SE：Java Standard Edition Java ME: Java Mobile Edition Java EE：Java Enterprise Edition Java是由Sun公司推出的（今年初被Oracle公司收购）。收购价格：74亿美金 J2SE、J2ME、J2EE JDK：Java Development
YII给用户登录加上验证码 dcj3sjt126com yii
1、在SiteController中添加如下代码： /** * Declares class-based actions. */ public function actions() { return array( // captcha action renders the CAPTCHA image displ
Lucene使用说明 dyy_gusi Lucene search 分词器
Lucene使用说明 1、lucene简介 1.1、什么是lucene Lucene是一个全文搜索框架，而不是应用产品。因此它并不像baidu或者googleDesktop那种拿来就能用，它只是提供了一种工具让你能实现这些产品和功能。 1.2、lucene能做什么要回答这个问题，先要了解lucene的本质。实际
学习编程并不难,做到以下几点即可! gcq511120594 数据结构编程算法
不论你是想自己设计游戏，还是开发iPhone或安卓手机上的应用，还是仅仅为了娱乐，学习编程语言都是一条必经之路。编程语言种类繁多，用途各异，然而一旦掌握其中之一，其他的也就迎刃而解。作为初学者，你可能要先从Java或HTML开始学，一旦掌握了一门编程语言，你就发挥无穷的想象，开发各种神奇的软件啦。 1、确定目标学习编程语言既充满乐趣，又充满挑战。有些花费多年时间学习一门编程语言的大学生到
Java面试十问之三：Java与C++内存回收机制的差别 HNUlanwei java C++finalize()堆栈内存回收
大家知道， Java 除了那 8 种基本类型以外，其他都是对象类型（又称为引用类型）的数据。 JVM 会把程序创建的对象存放在堆空间中，那什么又是堆空间呢？其实，堆（ Heap）是一个运行时的数据存储区，从它可以分配大小各异的空间。一般，运行时的数据存储区有堆（ Heap）和堆栈（ Stack），所以要先看它们里面可以分配哪些类型的对象实体，然后才知道如何均衡使用这两种存储区。一般来说，栈中存放的
第二章 Nginx+Lua开发入门 jinnianshilongnian nginx lua
Nginx入门本文目的是学习Nginx+Lua开发，对于Nginx基本知识可以参考如下文章： nginx启动、关闭、重启 http://www.cnblogs.com/derekchen/archive/2011/02/17/1957209.html agentzh 的 Nginx 教程 http://openresty.org/download/agentzh-nginx-tutor
MongoDB windows安装基本命令 liyonghui160com
windows安装安装目录： D:\MongoDB\ 新建目录 D:\MongoDB\data\db 4.启动进城： cd D:\MongoDB\bin mongod -dbpath D:\MongoDB\data\db &n
Linux下通过源码编译安装程序 pda158 linux
一、程序的组成部分　　Linux下程序大都是由以下几部分组成：　　二进制文件：也就是可以运行的程序文件　　库文件：就是通常我们见到的lib目录下的文件　　配置文件：这个不必多说，都知道　　帮助文档：通常是我们在linux下用man命令查看的命令的文档　　二、linux下程序的存放目录　　linux程序的存放目录大致有三个地方：　　/etc, /b
WEB开发编程的职业生涯４个阶段 shw3588 编程 Web 工作生活
觉得自己什么都会 2007年从学校毕业，凭借自己原创的ASP毕业设计，以为自己很厉害似的，信心满满去东莞找工作，找面试成功率确实很高，只是工资不高，但依旧无法磨灭那过分的自信，那时候什么考勤系统、什么OA系统、什么ERP，什么都觉得有信心，这样的生涯大概持续了约一年。根本不是自己想的那样 2008年开始接触很多工作相关的东西，发现太多东西自己根本不会，都需要去学，不管是asp还是js，
遭遇jsonp同域下变作post请求的坑 vb2005xu jsonp 同域post
今天迁移一个站点时遇到一个坑爹问题,同一个jsonp接口在跨域时都能调用成功,但是在同域下调用虽然成功,但是数据却有问题. 此处贴出我的后端代码片段 $mi_id = htmlspecialchars(trim($_GET['mi_id '])); $mi_cv = htmlspecialchars(trim($_GET['mi_cv '])); 贴出我前端代码片段: $.aj

AdaBoost基本原理与算法描述

一. 前言

二. AdaBoost基本原理介绍

2.1 AdaBoost分类问题

2.2 AdaBoost回归问题

2.3 AdaBoost前向分步算法

2.4 AdoBoost算法的正则化

三. AdaBoost算法流程描述

3.1 AdaBoost分类问题的算法流程描述

3.1.1 SAMME算法流程描述：

3.1.2 SAMME.R算法流程描述：

3.2 AdaBoost回归问题的算法流程描述

四. AdaBoost算法的优缺点

4.1 优点

4.2 缺点

五. 参考文献/博文

你可能感兴趣的:(机器学习)