海晨威

AdaBoost、GBDT、RF、XGboost、lightGBM的对比分析

文章目录

AdaBoost
GBDT
Random Forest
XGboost
LightGBM
CatBoost
对比分析

AdaBoost

简单介绍

AdaBoost是基于boosting的思想，通过多个弱分类器的线性组合来得到强分类器，训练时重点关注被错分的样本，准确率高的弱分类器权重大。

更深一步的介绍

在训练过程中，它不改变所给的训练数据，而是不断改变训练数据权值的分布，使得被误分类的数据再后一轮的分类中受到更大的关注。

同时采用加权多数表决的方法，加大分类误差率小的弱分类器的权值，使其在最后的表决中起更大的作用，减小分类误差率大的弱分类器的权值，使其在最后的表决中起较小的作用。所有弱分类器的权值之和并不为1，是通过最后结果的符号来决定实例的类别，该结果的绝对值表示分类的确信度。（参考《统计学习方法》P140）

Adaboost 还有另外一种理解，即可以认为其模型是加法模型、损失函数为指数函数、学习算法为前向分步算法的二类分类学习方法。(参考《统计学习方法》P143)

加法模型就是多个基函数线性组合得到的模型

前向分步算法：对于加法模型，从前往后，每一步只学习一个基函数及其系数，而不是一次性学习所有的基函数，从而简化优化的复杂度。

损失函数是根据 adaboost 算法特点推导而来的。

GBDT

简单介绍

GBDT是基于boosting的思想，串行地构造多棵决策树来进行数据的预测，它是在损失函数所在的函数空间中做梯度下降，即把待求的决策树模型当作参数，每轮迭代都去拟合损失函数在当前模型下的负梯度，从而使得参数朝着最小化损失函数的方向更新。

更深一步的介绍

GBDT可以看作是AdaBoost的一个推广，AdaBoost是通过错分数据点来识别问题，通过调整错分数据点的权重来改进模型，GBDT是通过负梯度来识别问题，通过计算负梯度来改进模型，实际上，负梯度绝对值大的样例同样会在之后的训练中受到更大的关注，因为它造成的损失更容易在最后的损失函数中占很大的比重，因此，需要更多地偏向于它去减小损失。这也是GBDT和AdaBoost相似的一个点，而相比AdaBoost, Gradient Boosting可以使用更多类型的损失函数，因此可以解决更多的问题。

最常见的损失函数是平方损失函数，square loss的优点是便于理解和实现，它的负梯度就是残差，而其他损失函数的负梯度只能看作残差的近似值，它的缺点在于对于异常值它的鲁棒性较差，因此会常用absolute loss或Huber loss来代替。

Random Forest

简单介绍

随机森林算法背后的思想是群体智慧的体现，它通过随机的行采样(bagging)和列采样(feature bagging)构造不同的训练集，建立一个决策树森林，利用加权平均方式或多数表决的方式得到最后的预测结果，能够并行学习，对噪声和异常数据具有很好的过滤作用，因此有很广泛的应用。

更深一步的介绍

随机森林的行采样(bagging)和列采样(feature bagging)都是为了减小模型之间的相关性使基学习器变得不同从而减小集成模型的方差，但这种随机性会导致随机森林的偏差有所增加（相比于单棵不随机树），因此随机森林的单棵树都会采用很深的决策树，并不进行剪枝操作，以减小每棵树的偏差，这使得每一棵决策树就是一个精通于某一个窄领域的专家（因为我们从全部特征中选择部分来让每一棵决策树学习），这样在随机森林中就有了很多个精通不同领域的专家，对一个新的问题（新的输入数据），可以用不同的角度去看待它，最终再通过投票或平均得到结果。这也正是群体智慧的体现。

XGboost

简单介绍

xgboost是梯度提升树的一种高效系统实现，是对GBDT进一步的改进，包括对代价函数进行了二阶泰勒展开，在代价函数里加入了正则项，借鉴了随机森林的列采样方法，支持并行计算等

更深一步的介绍

传统GBDT在优化时只用到一阶导数信息，xgboost则对代价函数进行了二阶泰勒展开，同时用到了一阶和二阶导数。顺便提一下，xgboost工具支持自定义代价函数，只要函数可一阶和二阶求导。
xgboost在代价函数里加入了正则项，用于控制模型的复杂度。正则项里包含了树的叶子节点个数、每个叶子节点上输出的score的L2模的平方和。从Bias-variance tradeoff角度来讲，正则项降低了模型的variance，使学习出来的模型更加简单，防止过拟合，这也是xgboost优于传统GBDT的一个特性。
Shrinkage（缩减），相当于学习速率（xgboost中的eta）。xgboost在进行完一次迭代后，会将叶子节点的权重乘上该系数，主要是为了削弱每棵树的影响，让后面有更大的学习空间。实际应用中，一般把eta设置得小一点，然后迭代次数设置得大一点。（补充：传统GBDT的实现也有学习速率）
列抽样（column subsampling）。xgboost借鉴了随机森林的做法，支持列抽样，不仅能降低过拟合，还能减少计算，这也是xgboost异于传统gbdt的一个特性。
对缺失值的处理。对于特征的值有缺失的样本，xgboost可以自动学习出它的分裂方向。
xgboost工具支持并行。boosting不是一种串行的结构吗?怎么并行的？注意xgboost的并行不是tree粒度的并行，xgboost也是一次迭代完才能进行下一次迭代的（第t次迭代的代价函数里包含了前面t-1次迭代的预测值）。xgboost的并行是在特征粒度上的。我们知道，决策树的学习最耗时的一个步骤就是对特征的值进行排序（因为要确定最佳分割点），xgboost在训练之前，预先对数据进行了排序，然后保存为block结构，后面的迭代中重复地使用这个结构，大大减小计算量。这个block结构也使得并行成为了可能，在进行节点的分裂时，需要计算每个特征的增益，最终选增益最大的那个特征去做分裂，那么各个特征的增益计算就可以开多线程进行。
可并行的近似直方图算法。树节点在进行分裂时，我们需要计算每个特征的每个分割点对应的增益，即用贪心法枚举所有可能的分割点。当数据无法一次载入内存或者在分布式情况下，贪心算法效率就会变得很低，所以xgboost还提出了一种可并行的近似直方图算法，用于高效地生成候选的分割点。

这里参考：机器学习算法中 GBDT 和 XGBOOST 的区别有哪些？

LightGBM

简单介绍

LightGBM是一个实现GBDT算法的分布式高效框架。它通过leaf-wise分裂方法进行决策树的生成，通过基于直方图的算法寻找特征分割点，并支持并行学习，能够更高效的处理大数据，也得到了越来越广泛的应用。

更深一步的介绍

首先，它通过leaf-wise分裂方法产生比level-wise分裂方法更复杂的树，能够实现更高的准确率。虽然这样有时候会导致过拟合，但可以通过设置 max-depth 参数来防止过拟合的发生。（每一次的生长都是选取分裂增益最高的节点，而不是对一层中的所有节点都进行分裂）。

其次，它使用基于直方图的算法，将连续的特征值分桶(buckets)装进离散的箱子(bins)，并通过直方图做差加速计算兄弟节点的直方图，能够加速训练过程，并实现更少的内存占用。

另外，它支持并行学习，包括特征并行和数据并行

特征并行的主要思想是不同机器在不同的特征集合上分别寻找最优的分割点，然后在机器间同步最优的分割点。（mapreduce思想）
数据并行则是让不同的机器先在不同的记录集合上构造直方图，然后进行全局的合并，最后在合并的直方图上面寻找最优分割点。

它还支持直接输入类别特征，在对离散类别特征分裂时，每个取值都当作一个桶，分裂时的增益算的是”是否属于某个类别“的增益，对于类别特征的操作类似于one-hot编码。

CatBoost

简单介绍

CatBoost是Category 和 Boosting的缩写，最大的特点就是可以直接处理类别特征，不需要任何预处理来将类别转换为数字。

具体详细的介绍请参考：CatBoost原理及实践

对比分析

xgb是对gbdt的优化改进

1、目标函数中加入了正则项来控制模型的复杂度，替代原来的剪枝方法。

2、利用了one-hot编码等情况中的特征稀疏性。（仅对特征值为非缺失值的样本的特征进行遍历）

3、支持列抽样（同random forest）。

4、数据事先排序并按block结构保存，有利于并行运算（树的生成还是串行的，这里说的并行计算指并行计算各个特征的增益或是基尼系数）。除此之外，xgb还通过一种可并行的近似直方图算法来高效生成候选的分割点。

5、对损失函数进行了优化，gbdt只用到了其一阶导数信息，而xgb同时用到其一阶导与二阶导。

lgb则是在xgb基础上进一步改进

1、内存需求小：xgb使用基于pre-sorted的决策树算法，而lgb使用基于histogram的决策树算法。histogram算法占用的内存很小：pre-sorted需要两倍数据大小的内存空间，一半用于数据（float32），一半用于存放排好序的索引，而histogram不需要存放索引，且特征值只需要存放离散后的值，用uint8即可，故内存需求仅为pre-sorted的1/8。

2、计算速度快：决策树算法的主要操作包括“寻找分割点”与“数据分割”两步，pre-sorted算法和histogram算法在“寻找分割点”上的时间复杂度是一致的；但是在“数据分割”上histogram要快，histogram所有特征共享一张索引，而pre-sorted一个特征对应一张索引，若集合level-wise，pre-sorted也可以共用一张索引，但是会带来很多随机访问的问题，速度仍不及histogram。此外，histogram算法还减少了计算分割点增益的次数。

3、通信代价小：histogram算法的通信代价远远小于pre-sorted，可用于分布式计算。

但是，histogram不能找到很精确的分割点，训练误差不如pre-sorted算法，可以说是牺牲一定精度来换取速度。需要指出的是，这种粗犷的分割相当于自带正则效果，所以测试集的误差两种决策树算法差距不大。

以上参考：http://www.cnblogs.com/asprin/p/9267453.html

关键两点差别

1、决策树算法

XGBoost使用的是pre-sorted算法，能够更精确的找到数据分隔点；LightGBM使用的是histogram算法，占用的内存更低，数据分隔的复杂度更低。

2、决策树生长策略

XGBoost采用的是level（depth）-wise生长策略，能够同时分裂同一层的叶子，从而进行多线程优化，不容易过拟合；但不加区分的对待同一层的叶子，带来了很多没必要的开销。

LightGBM采用leaf-wise生长策略，每次从当前所有叶子中找到分裂增益最大（一般也是数据量最大）的一个叶子，然后分裂，如此循环；但会生长出比较深的决策树，产生过拟合。因此，LightGBM 在leaf-wise 之上增加了一个最大深度的限制，在保证高效率的同时防止过拟合。

20 条实用的创业实战指南：初创项目如何提升竞争力？人工智能
作者：LmrankHan，AllianceDao核心贡献者编译：J1N，TechubNews我最近在SolanaBreakpoint上发表了主题演讲，目的是在有限的时间内为加密货币项目创始人提供尽可能多有价值的信息。我的演讲反响很好，所以我想花点时间详细整理阐述一下，让人们可以快速从中获得收益。从解决小问题开始从解决小问题或设计一个小的领域开始。而不是一开始就瞄准一个庞大的市场，创始人应该专注于解
python081（包02—封装模块、设置__init__和外界导入包） weixin_42681308 Python
案例演练新建一个hm_message的包在目录下，新建两个文件send_message和receive_message在send_message文件中定义一个send函数在receive_message文件中定义一个receive函数在外部直接导入hm_message的包__init__.py要在外界使用包中的模块，需要在__init__.py中指定对外界提供的模块列表
机器学习、基础算法、python常见面试题必知必答系列大全：（面试问题持续更新） promptllm人工智能
基础算法常见面试篇1.1过拟合和欠拟合常见面试篇一、过拟合和欠拟合是什么？二、过拟合/高方差（overfiting/highvariance）篇2.1过拟合是什么及检验方法？2.2导致过拟合的原因是什么？2.3过拟合的解决方法是什么？三、欠拟合/高偏差（underfiting/highbias）篇3.1欠拟合是什么及检验方法？3.2导致欠拟合的原因是什么？3.3过拟合的解决方法是什么？1.2Bat
wps2019数据分析加载项_《07版office办公软件中的excle中，为什么在加载项里选择了分析工具库，数据分析还是显示不出来？》 wps数据分析加载项... 孙伟莲 wps2019数据分析加载项
如何利用excle做数据分析excel完全可以解决！可以通过数据透视表，筛选出你的各种需求，但是要求操作要熟练，没办法在这里描述清楚的07版office办公软件中的excle中，为什么在加载项里选择了分析工具库，数据分析还是显示不出来？当你有某一个表格需要导出数据时，点击页面上方的输出，出现一个另存为的对话框，先选择保存的位置，然后输入文件名，在保存类型中选excel点保存！这样你的表格就在你的存
wps2019数据分析加载项_wpsexcel数据分析工具在哪里延静斋孙 wps2019数据分析加载项
WPS中Excel表格的功能非常强大，不仅仅能够统计数据，而且还可以分析数据，这也是我们处理大量数据的最快捷的方法，感兴趣的小伙伴可以来看看哦。WPS中如何将表格中的数据在表格中以柱状图显示运用条件格式中数据条即可达到效果如何调出wps的excel“数据”中“数据透视表和数据透视图”选项？1，选中图标，注意图表要，然后点击“插入”--“数据透视表”。2，选择数据区域，点击“确定”。3，然后把字段拖
AI 基础设施的儿童保护：智能化儿童安全监护系统 AI天才研究院【精选大厂面试题详解】大厂Offer收割机面试题简历程序员读书硅基计算碳基计算认知计算生物计算深度学习神经网络大数据 AIGC AGI LLM Java Python 架构设计 Agent 程序员实现财富自由
AI基础设施的儿童保护：智能化儿童安全监护系统随着人工智能技术的快速发展，AI基础设施在儿童保护方面发挥着越来越重要的作用。智能化儿童安全监护系统通过应用AI技术，为儿童的安全保驾护航。本文将探讨该领域的典型问题/面试题库和算法编程题库，并给出详尽的答案解析说明和源代码实例。1.AI技术在儿童保护中的应用题目：请简要介绍AI技术在儿童保护中的几种应用。答案：AI技术在儿童保护中的应用主要包括：人脸
CityMaker教程初级篇（一）如何加载三维控件风起于青萍初级篇 CityMaker .net 控件三维
.Net中如何加载CityMaker的三维控件-自从使用COM开始，小编就遇到关于如何加载COM控件的诸多问题，不夸张的说这是每个在.NET使用COM的人都无可避免的问题。要么加载不上，要么就是加载上了，窗体设计器出不来，还有可能是加载正常，但无法初始化。愚笨的小编是一次又一次的尝试，终于梳理通了从COM到.Net的思路。为此小编特地写一篇教程，帮助那些使用COM组件，尤其是CityMaker的C
Python软件包中的__init__.py文件的作用 python_136 python
当然可以，我会尽量用更详细和易懂的方式来说明Python软件包中的__init__.py文件的作用。一、__init__.py文件的基本作用在Python中，一个包含__init__.py文件的目录被视为一个Python包。这个文件的存在告诉Python解释器，这个目录应该被当作一个整体来对待，里面的Python文件（.py文件）可以被当作模块（module）来导入。二、__init__.py文件
Css3 3D转换黄丫丫07 css3 3d css
特点：近大远小物体后面遮挡不可见三维坐标系：三维坐标系其实就是指立体空间，立体空间是由3个轴共同组成的。X轴：水平向右为正Y轴：垂直向下为正Z轴：垂直屏幕向外为正3D位移和3D旋转：主要知识点：3D位移：translate3d（x,y,z）3D旋转：rotate3d(x,y,z)透视：perspective3D呈现transform-style3D位移：translate3d（x,y,z）:Tra
大数据平台Bug Bash大扫除最佳实践京东云开发者大数据 bug bash
作者：尹伟一、背景随着越来越多的"新人"在日常工作以及大促备战中担当大任，我们发现仅了解自身系统业务已不能满足日常系统开发运维需求。为此，大数据平台部门组织了一次BugBash活动，既能提升自己对兄弟产品的理解和使用，又能促使自家产品功能日趋完善。今天来给大家分享一些实际操作过程和经验总结~二、什么是BugBash？BugBash，顾名思义就是缺陷大扫除。通常由QA主导发起，团队全员放下手中的活，
Bootstrap4网格系统详解半点寒12W css css3
一、基本概念Bootstrap4的网格系统是其核心部分，它基于一个12列的布局，能够帮助你轻松创建响应式的网页布局。这种网格系统可以让你将页面内容划分为不同的行和列，使得内容在不同设备上都能呈现出最佳的显示效果。二、容器（Container）容器的作用：容器是用来包裹页面内容的元素，它提供了一个水平居中的布局空间，并为内部的行和列设置了合适的内边距。容器的类型：**.container：**这是一
CSS3 2D 转换介绍半点寒12W css css3 css 前端
CSS3中的2D转换（2DTransforms）允许你在二维平面上对元素进行操作，如移动、旋转、缩放和倾斜等，这可以让网页的布局和动画效果更加丰富多样。以下是一些主要的2D转换方法：一、translate（移动）语法：transform:translate(x,y);或者transform:translateX(x);和transform:translateY(y);。其中x和y是长度值（可以是像
SQL语言中的查询语句整理唐僧洗头爱飘柔9527 sql mysql 数据库
1、查询语句的介绍：本篇主要介绍sql语句里的查询语句，这其中包括了查询语句中的子内容，也就是拓展的内容，这些内容代入到查询语句中将会有更多的反应。2、查询语句：FROM命令：SELECT字段1,字段2,字段3FROM表文件名执行顺序：mysql共有7个查询命令，FROM命令永远是第一个执行的查询命令执行作用：FROM命令相当于一个读取流，分则将硬盘上表文件加载到内存中生成一个【临时表】供后续查询
RocketMQ源码之消息刷盘分析小虾米 ~ RocketMQ rocketmq
前言刷盘是将内存中的消息写入磁盘，分为同步刷盘和异步刷盘。同步刷盘指一条消息写入磁盘才返回成功，异步刷盘指写入内存就返回成功，稍后异步线程刷盘。在创建CommitLog对象的时候，会初始化刷盘服务：//代码位置：org.apache.rocketmq.store.CommitLogpublicCommitLog(finalDefaultMessageStoredefaultMessageStore
分布式IO模块与S7-1200 PLC：打造高效分拣系统的新引擎明达技术分布式物联网
在现代化物流中心，快速、高效、准确的包裹分拣是衡量整个系统性能的关键指标。为了实现这一目标，国产IO模块与西门子S7-1200PLC的结合应用，正成为越来越多企业的首选方案。这一组合不仅优化了数据采集和处理流程，还显著提升了分拣效率，降低了运营成本。精准配合分布式IO模块是工业自动化系统中的关键组件，负责采集现场设备的各种信号，并将这些信号转换为数字信号传输给PLC。在分拣系统中，这些模块外接了各
Python : CCF-CSP真题——坐标变换（其一）我是阿核 Python 算法 leetcode python 经验分享
试题编号：202309-1试题名称：坐标变换（其一）时间限制：1.0s内存限制：512.0MB问题描述：问题描述对于平面直角坐标系上的坐标(x,y)，小P定义了一个包含n个操作的序列T=(t1,t2,⋯,tn)。其中每个操作ti（1≤i≤n）包含两个参数dxi和dyi，表示将坐标(x,y)平移至(x+dxi,y+dyi)处。现给定m个初始坐标，试计算对每个坐标(xj,yj)（1≤j≤m）依次进行T
关于怎样解决pycharm中编码格式的问题李雨非-19期-河北工职大 python pycharm ide python
一点开头首先，需要清楚pycharm中它自行默认设置的格式是GBK或是UTF-8，而GBK解释器可能会因为文件的信息写入与读取而返回错误。实现流程在PyCharm中修改编码格式可以通过以下步骤实现：打开需要修改编码格式的文件点击菜单栏中的File--->Settings（或者快捷键Ctrl+Alt+S）在弹出的窗口中选择Editor--->FileEncodings将GlobalEncoding和
LeetCode100之搜索旋转排序数组(33)--Java xiao--xin Leetcode 算法 leetcode 数据结构 java 二分查找
1.问题描述整数数组nums按升序排列，数组中的值互不相同。在传递给函数之前，nums在预先未知的某个下标k（0nums[nums.length-1]&&targetnums[nums.length-1]){left=mid+1;continue;}......}如果我们已经完全在我们确定的二分查找范围之内了，就按照正常的二分判断进行查找即可。while(leftnums[nums.length-
MarsCode算法题之简单四则运算解析器 xiao--xin 豆包MarsCode算法题 java 开发语言 MarsCode 算法数据结构
1.问题描述小F面临一个编程挑战：实现一个基本的计算器来计算简单的字符串表达式的值。该字符串表达式有效，并可能包含数字（0-9）、运算符+、-及括号()。注意，字符串中不包含空格。除法运算应只保留整数结果。请实现一个解析器计算这些表达式的值，且不使用任何内置的eval函数。示例1输入：expression="1+1"输出：2示例2输入：expression="3+4*5/(3+2)"输出：7示例3
Ubuntu 完整卸载 WPS Office (deb包安装版) 小白也有IT梦 ubuntu wps linux
1.主程序卸载#使用dpkg卸载WPSOfficesudodpkg-rwps-office#完全清理包括配置文件sudodpkg--purgewps-office2.删除用户配置文件#删除用户目录下的配置文件和缓存rm-rf~/.config/Kingsoftrm-rf~/.cache/Kingsoft3.清理系统残留文件#删除系统中的WPS相关文件sudorm-rf/usr/share/font
大三学生面试经历（2）无限大. 面试面试职场和发展
继续昨天的内容，我面试的是一个Java实习岗，但是居然也问了我前端（vue）相关的问题最大的感觉就是，现在真的越来越卷了，后端都把前端的东西卷完了，当时是线上面试，感觉答的不太好（因为确实没准备的太全），接下来的时间继续加强加强这些方面的学习愿与诸君共勉！具体如下1.请简述Vue.js的生命周期函数及其执行顺序2.Vue.js中的v-bind指令和v-model指令有什么区别?3.请简述Vue.j
计算1+2+3+4+5+6...+100用python_100个Python练手小程序，学习python的很好的资料 weixin_39879881
原标题：100个Python练手小程序，学习python的很好的资料100个Python练手小程序，学习python的很好的资料，覆盖了python中的每一部分，可以边学习边练习，更容易掌握python。本文附带基础视频教程：私信回复【基础】就可以获取的【程序1】题目：有1、2、3、4个数字，能组成多少个互不相同且无重复数字的三位数？都是多少？1.程序分析：可填在百位、十位、个位的数字都是1、2、
计算1+2+3+4+5+6...+100用python_循环 - 廖雪峰的官方网站 weixin_39809140
循环要计算1+2+3，我们可以直接写表达式：>>>1+2+36要计算1+2+3+...+10，勉强也能写出来。但是，要计算1+2+3+...+10000，直接写表达式就不可能了。为了让计算机能计算成千上万次的重复运算，我们就需要循环语句。Python的循环有两种，一种是for...in循环，依次把list或tuple中的每个元素迭代出来，看例子：names=['Michael','Bob','Tr
android备忘录app设计er图,图、流程图、ER图怎么画及常见画图工具（流程图文章汇总）... weixin_39714164
跟我一起写Makefile---变量(嵌套变量+追加变量+overrid+多行变量+环境变量+目标变量+模式变量)目录(?)[-]使用变量一变量的基础二变量中的变量三变量高级用法四追加变量值五override指示符六多行变量七环境变量八目标变量九模式变量使用变量————在Makefil...UVA10537TheToll!Rev
电子元器件的测量 weibangwen123 笔记
电子元器件实验是电子信息工程专业必不可少的实验，它能让学生了解电子元器件并且如何测量。首先，我们组测量的电子元器件:三极管，电容，电位器，发光二极管，跳线，导线，电阻，电池的阻容，变压器，电解电容。其中三极管是电流控制元件，用小电流来控制大电流，宏观现象为微观弱信号放大辐值大的信号，也可用作无触点开关。发光二极管引脚长的为正，极短的为负极，内部精品是led的核心部件，它的外表环氧树脂。它发光的原理
python保留字符串中数字，去除字母，再转化为Int类型操作梦云澜 python python 开发语言
现在我们有一个这样的分类列表：categories=['Layer1','Layer2','Layer3','Layer4','Layer5','Layer6','WM']我们想保留其中的分类的数字，去除字母，该怎么做呢？首先第一步：importpandasaspdimportre#原始分类数据categories=['Layer1','Layer2','Layer3','Layer4','Lay
pythonAI算法中使用ffmpeg推流记录脱僵的的野码 ffmpeg 网络
首先呢需求是这样的需要在远端播放检测的画面这个事情解决的思路1.用的网络摄像头，将摄像头的流推到rtmp1流地址2.项目中的输入流就是rtmp1的地址视频流3.开始对视频各种检测，检测后将帧的frame推到rtmp24.随便找个播放器去播放rtmp2的流期间遇到了一些问题就是推上去的流在远端播放就直接裂开了大概4秒一卡顿，后来发现是ffmpg-r参数默认值是25我的frame推上去的流fps才11
多张图片读入后组成一个矩阵。怎么读取图片，可以让其读入的形式是：ndarray（a,b,c）分别的含义：a为多少张图片，b*c为图片大小洛水微寒矩阵线性代数
不显示通道数：要将多张图片读取为一个NumPy数组（ndarray），其中a表示图片数量，b和c分别表示每张图片的高度和宽度（不显示通道数），你可以使用Python中的PIL（Pillow）库和NumPy库。下面是一个示例代码，展示了如何实现这一点：代码示例importnumpyasnpfromPILimportImageimportosdefload_images_from_folder(fol
Redis 秋枫博客 redis redis
redisRedis是什么是一个高性能的key-value形式的数据库常常被用于缓存Redis有什么优势内存数据库，速度快，也支持数据的持久化，可以将内存中的数据保存在磁盘中，重启的时候可以再次加载进行使用。Redis读的速度是110000次/s,写的速度是81000次/s，且是单台服务器的Redis不仅仅支持简单的key-value类型的数据，同时还提供list，set，zset，hash等数据
5.C++中的数组和Vector 赵鑫亿 C++基础入门 c++开发语言
C++中的数组和Vector数组的基本使用定义与初始化静态数组：定义时指定固定大小并可同时初始化。例如intarr1[5]={1,2,3,4,5};定义了一个包含5个整数的数组。也可部分初始化，如intarr2[5]={1,2};，未初始化的元素自动初始化为0。动态数组：使用new关键字在堆上动态分配内存创建。如int*dynamicArr=newint[10];，需手动用delete[]释放内存
Enum用法不懂事的小屁孩 enum
以前的时候知道enum，但是真心不怎么用，在实际开发中，经常会用到以下代码: protected final static String XJ = "XJ"; protected final static String YHK = "YHK"; protected final static String PQ = "PQ";
【Spark九十七】RDD API之aggregateByKey bit1129 spark
1. aggregateByKey的运行机制 /** * Aggregate the values of each key, using given combine functions and a neutral "zero value". * This function can return a different result type
hive创建表是报错： Specified key was too long; max key length is 767 bytes daizj hive
今天在hive客户端创建表时报错，具体操作如下 hive> create table test2(id string); FAILED: Execution Error, return code 1 from org.apache.hadoop.hive.ql.exec.DDLTask. MetaException(message:javax.jdo.JDODataSto
Map 与 JavaBean之间的转换周凡杨 java 自省转换反射
最近项目里需要一个工具类，它的功能是传入一个Map后可以返回一个JavaBean对象。很喜欢写这样的Java服务，首先我想到的是要通过Java 的反射去实现匿名类的方法调用，这样才可以把Map里的值set 到JavaBean里。其实这里用Java的自省会更方便，下面两个方法就是一个通过反射，一个通过自省来实现本功能。 1：JavaBean类 1 &nb
java连接ftp下载 g21121 java
有的时候需要用到java连接ftp服务器下载，上传一些操作，下面写了一个小例子。 /** ftp服务器地址 */ private String ftpHost; /** ftp服务器用户名 */ private String ftpName; /** ftp服务器密码 */ private String ftpPass; /** ftp根目录 */ private String f
web报表工具FineReport使用中遇到的常见报错及解决办法（二）老A不折腾 finereport web报表 java报表总结
抛砖引玉，希望大家能把自己整理的问题及解决方法晾出来，Mark一下，利人利己。出现问题先搜一下文档上有没有，再看看度娘有没有，再看看论坛有没有。有报错要看日志。下面简单罗列下常见的问题，大多文档上都有提到的。 1、没有返回数据集：在存储过程中的操作语句之前加上set nocount on 或者在数据集exec调用存储过程的前面加上这句。当S
linux 系统cpu 内存等信息查看墙头上一根草 cpu 内存 liunx
1 查看CPU 　　1.1 查看CPU个数　　# cat /proc/cpuinfo | grep "physical id" | uniq | wc -l 　　2 　　**uniq命令：删除重复行;wc –l命令：统计行数** 　　1.2 查看CPU核数　　# cat /proc/cpuinfo | grep "cpu cores" | u
Spring中的AOP aijuans spring AOP
Spring中的AOP Written by Tony Jiang @ 2012-1-18 （转）何为AOP AOP，面向切面编程。在不改动代码的前提下，灵活的在现有代码的执行顺序前后，添加进新规机能。来一个简单的Sample: 目标类： [java] view plain copy print ? package&nb
placeholder(HTML 5) IE 兼容插件 alxw4616 JavaScript jquery jQuery插件
placeholder 这个属性被越来越频繁的使用. 但为做HTML 5 特性IE没能实现这东西. 以下的jQuery插件就是用来在IE上实现该属性的. /** * [placeholder(HTML 5) IE 实现.IE9以下通过测试.] * v 1.0 by oTwo 2014年7月31日 11:45:29 */ $.fn.placeholder = function
Object类,值域,泛型等总结(适合有基础的人看) 百合不是茶泛型的继承和通配符变量的值域 Object类转换
java的作用域在编程的时候经常会遇到,而我经常会搞不清楚这个问题,所以在家的这几天回忆一下过去不知道的每个小知识点变量的值域; package 基础; /** * 作用域的范围 * * @author Administrator * */ public class zuoyongyu { public static vo
JDK1.5 Condition接口 bijian1013 java thread Condition java多线程
Condition 将 Object 监视器方法（wait、notify和 notifyAll）分解成截然不同的对象，以便通过将这些对象与任意 Lock 实现组合使用，为每个对象提供多个等待 set （wait-set）。其中，Lock 替代了 synchronized 方法和语句的使用，Condition 替代了 Object 监视器方法的使用。条件（也称为条件队列或条件变量）为线程提供了一
开源中国OSC源创会记录 bijian1013 hadoop spark MemSQL
一.Strata+Hadoop World（SHW）大会是全世界最大的大数据大会之一。SHW大会为各种技术提供了深度交流的机会，还会看到最领先的大数据技术、最广泛的应用场景、最有趣的用例教学以及最全面的大数据行业和趋势探讨。二.Hadoop &nbs
【Java范型七】范型消除 bit1129 java
范型是Java1.5引入的语言特性，它是编译时的一个语法现象，也就是说，对于一个类，不管是范型类还是非范型类，编译得到的字节码是一样的，差别仅在于通过范型这种语法来进行编译时的类型检查，在运行时是没有范型或者类型参数这个说法的。范型跟反射刚好相反，反射是一种运行时行为，所以编译时不能访问的变量或者方法(比如private)，在运行时通过反射是可以访问的，也就是说，可见性也是一种编译时的行为，在
【Spark九十四】spark-sql工具的使用 bit1129 spark
spark-sql是Spark bin目录下的一个可执行脚本，它的目的是通过这个脚本执行Hive的命令，即原来通过 hive>输入的指令可以通过spark-sql>输入的指令来完成。 spark-sql可以使用内置的Hive metadata-store，也可以使用已经独立安装的Hive的metadata store 关于Hive build into Spark
js做的各种倒计时 ronin47 js 倒计时
第一种：精确到秒的javascript倒计时代码 HTML代码: <form name="form1"> <div align="center" align="middle"
java-37.有n 个长为m+1 的字符串，如果某个字符串的最后m 个字符与某个字符串的前m 个字符匹配，则两个字符串可以联接 bylijinnan java
public class MaxCatenate { /* * Q.37 有n 个长为m+1 的字符串，如果某个字符串的最后m 个字符与某个字符串的前m 个字符匹配，则两个字符串可以联接， * 问这n 个字符串最多可以连成一个多长的字符串，如果出现循环，则返回错误。 */ public static void main(String[] args){
mongoDB安装开窍的石头 mongodb安装基本操作
mongoDB的安装 1:mongoDB下载 https://www.mongodb.org/downloads 2:下载mongoDB下载后解压
[开源项目]引擎的关键意义 comsci 开源项目
一个系统，最核心的东西就是引擎。。。。。而要设计和制造出引擎，最关键的是要坚持。。。。。。现在最先进的引擎技术，也是从莱特兄弟那里出现的，但是中间一直没有断过研发的
软件度量的一些方法 cuiyadll 方法
软件度量的一些方法http://cuiyingfeng.blog.51cto.com/43841/6775/在前面我们已介绍了组成软件度量的几个方面。在这里我们将先给出关于这几个方面的一个纲要介绍。在后面我们还会作进一步具体的阐述。当我们不从高层次的概念级来看软件度量及其目标的时候，我们很容易把这些活动看成是不同而且毫不相干的。我们现在希望表明他们是怎样恰如其分地嵌入我们的框架的。也就是我们度量的
XSD中的targetNameSpace解释 darrenzhu xml namespace xsd targetnamespace
参考链接: http://blog.csdn.net/colin1014/article/details/357694 xsd文件中定义了一个targetNameSpace后，其内部定义的元素，属性，类型等都属于该targetNameSpace,其自身或外部xsd文件使用这些元素，属性等都必须从定义的targetNameSpace中找：例如：以下xsd文件，就出现了该错误，即便是在一
什么是RAID0、RAID1、RAID0+1、RAID5，等磁盘阵列模式? dcj3sjt126com raid
RAID 1又称为Mirror或Mirroring，它的宗旨是最大限度的保证用户数据的可用性和可修复性。 RAID 1的操作方式是把用户写入硬盘的数据百分之百地自动复制到另外一个硬盘上。由于对存储的数据进行百分之百的备份，在所有RAID级别中，RAID 1提供最高的数据安全保障。同样，由于数据的百分之百备份，备份数据占了总存储空间的一半，因而，Mirror的磁盘空间利用率低，存储成本高。 Mir
yii2 restful web服务快速入门 dcj3sjt126com PHP yii2
快速入门 Yii 提供了一整套用来简化实现 RESTful 风格的 Web Service 服务的 API。特别是，Yii 支持以下关于 RESTful 风格的 API：支持 Active Record 类的通用API的快速原型涉及的响应格式（在默认情况下支持 JSON 和 XML) 支持可选输出字段的定制对象序列化适当的格式的数据采集和验证错误
MongoDB查询(3)——内嵌文档查询（七） eksliang MongoDB查询内嵌文档 MongoDB查询内嵌数组
MongoDB查询内嵌文档转载请出自出处：http://eksliang.iteye.com/blog/2177301 一、概述有两种方法可以查询内嵌文档：查询整个文档；针对键值对进行查询。这两种方式是不同的，下面我通过例子进行分别说明。二、查询整个文档例如:有如下文档 db.emp.insert({ &qu
android4.4从系统图库无法加载图片的问题 gundumw100 android
典型的使用场景就是要设置一个头像，头像需要从系统图库或者拍照获得，在android4.4之前，我用的代码没问题，但是今天使用android4.4的时候突然发现不灵了。baidu了一圈，终于解决了。下面是解决方案： private String[] items = new String[] { "图库","拍照" }; /* 头像名称 */
网页特效大全 jQuery等 ini JavaScript jquery css html5 ini
HTML5和CSS3知识和特效 asp.net ajax jquery实例分享一个下雪的特效 jQuery倾斜的动画导航菜单选美大赛示例你会选谁 jQuery实现HTML5时钟功能强大的滚动播放插件JQ-Slide 万圣节快乐！！！向上弹出菜单jQuery插件 htm5视差动画 jquery将列表倒转顺序推荐一个jQuery分页插件 jquery animate
swift objc_setAssociatedObject block(version1.2 xcode6.4) 啸笑天 version
import UIKit class LSObjectWrapper: NSObject { let value: ((barButton: UIButton?) -> Void)? init(value: (barButton: UIButton?) -> Void) { self.value = value
Aegis 默认的 Xfire 绑定方式，将 XML 映射为 POJO MagicMa_007 java POJO xml Aegis xfire
Aegis 是一个默认的 Xfire 绑定方式，它将 XML 映射为 POJO, 支持代码先行的开发.你开发服务类与 POJO,它为你生成 XML schema/wsdl XML 和注解映射概览默认情况下，你的 POJO 类被是基于他们的名字与命名空间被序列化。如果
js get max value in (json) Array qiaolevip 每天进步一点点学习永无止境 max 纵观千象
// Max value in Array var arr = [1,2,3,5,3,2];Math.max.apply(null, arr); // 5 // Max value in Jaon Array var arr = [{"x":"8/11/2009","y":0.026572007},{"x"
XMLhttpRequest 请求 XML,JSON ,POJO 数据 Luob. POJO json Ajax xml XMLhttpREquest
在使用XMlhttpRequest对象发送请求和响应之前，必须首先使用javaScript对象创建一个XMLHttpRquest对象。 var xmlhttp； function getXMLHttpRequest(){ if(window.ActiveXObject){ xmlhttp:new ActiveXObject("Microsoft.XMLHTTP
jquery wuai jquery
以下防止文档在完全加载之前运行Jquery代码，否则会出现试图隐藏一个不存在的元素、获得未完全加载的图像的大小等等 $(document).ready(function(){ jquery代码; }); <script type="text/javascript" src="c:/scripts/jquery-1.4.2.min.js&quo

AdaBoost、GBDT、RF、XGboost、lightGBM的对比分析

文章目录

AdaBoost

GBDT

Random Forest

XGboost

LightGBM

CatBoost

对比分析

你可能感兴趣的:(机器学习笔记,机器学习中的小思考)