XTX_AI

【Darknet版YOLOv3&YOLOv4模型训练】

Darknet版YOLOv3&YOLOv4模型训练

- 1、`CMake` 是一个跨平台的自动化构建系统 ‍️‍️‍️
- 2、yolov3搭建
- 3、`yolov3`自己训练`voc2012`数据集：✍️✍️✍️
- 4、yolov4搭建 #和v3差不多 ‍️‍️‍️
- 5、制作VOC数据集 ‍️‍️‍️
- 6、Keras/Tensorflow+python+yolo3训练自己的数据集 ✍️✍️✍️
- 7、keras ‍️‍️‍️
- 8、训练数据集时注意事项 ‍️‍️‍️
- 9、防止过拟合 ‍️‍️‍️

1、`CMake` 是一个跨平台的自动化构建系统 ‍️‍️‍️

CMake 是一个跨平台的自动化构建系统,它使用一个名为 CMakeLists.txt 的文件来描述构建过程,可以产生标准的构建文件,如 Unix 的 Makefile 或Windows Visual C++ 的 projects/workspaces 。文件 CMakeLists.txt 需要手工编写,也可以通过编写脚本进行半自动的生成。CMake 提供了比 autoconfig 更简洁的语法。在 linux 平台下使用CMake 生成 Makefile 并编译的流程如下:
1. 编写 CmakeLists.txt。
2. 执行命令 “cmake PATH” 或者 “ccmake PATH” 生成 Makefile ( PATH 是 CMakeLists.txt 所在的目录 )。
3. 使用 make 命令进行编译。
把开发环境转移到Linux下，同时也准备阅读些GitHub上的开源代码，开源项目一般都是用CMake管理的。CMake所做的事其实就是告诉编译器如何去编译链接源代码。你也许想问不是有makefile吗，为什么还要它？这里就牵涉到跨平台问题。在Windows平台下是通过project文件去管理这些的，如果不用CMake，那我们为Windows和Linux系统就要写对应的project文件和makefile文件，这无疑是一件繁琐的事，而我们只要编写一次CMake，就可以用在各个平台，而且其语法也简单。目前CMake 3.12.2已经可以下载，在Ubuntu 18.04可以更新到最新的CMake版本。

2、yolov3搭建

在darknet官网下载源码（也就是名为darknet的项目文件夹），放入主目录；或者在主目录下打开终端，输入一下代码进行源码下载。
终端下载及编译步骤如下：

git clone https://github.com/pjreddie/darknet
cd darknet
make

之后下载yolov3.weights权重文件，可以直接在darknet文件夹内打开终端输入
wget https://pjreddie.com/media/files/yolov3.weights 下载，或者打开浏览器 https://pjreddie.com/media/files/yolov3.weights 用链接下载，之后大权重文件放入darknet文件夹内。（都很慢）
下面测试一下！

./darknet detect cfg/yolov3.cfg yolov3.weights data/dog.jpg

若要在GPU上跑，要修改一些参数，darknetwen文件夹内的makefile文件修改：

GPU=1
CUDNN=1
OPENCV=１ # 如果安装了opencv则改为１,在中终端中执行sudo apt-get install libopencv-dev  即可
OPENMP=0
DEBUG=0
...
NVCC=/usr/local/cuda-10.2/bin/nvcc # 原为 NVCC = nvcc，cuda后面的紧跟自己的cuda版本，如cuda-9.0，cuda-10.0等
ARCH= -gencode arch=compute_75,code=sm_75 \   #算力改为75

改完之后再make一下，在测试。(别的电脑上的项目文件一定要重新设置编译)

3、`yolov3`自己训练`voc2012`数据集：✍️✍️✍️

步骤如下：
1、把下载好的解压后的VOC数据集文件夹放到项目文件夹下（我是只打算训练voc2012数据集，也可以下载voc2007数据集一块训练），下载后的文件夹名为PascalVOC2012，
2、为图片数据集生成txt的标签文件，下载voc_label.py文件并运行，将文件下载到VOCdevkit同级的路径下，生成训练和验证的文件列表，如果下载好了darknet项目，在darknet/scripts/目录下也有voc_lable.py，下载voc_lable.py命令并运行如下：

wget https://pjreddie.com/media/files/voc_label.py
python voc_label.py

然后会在PascalVOC2012文件夹下VOCdevkit同级的路径下生成2012_train.txt和2012_val.txt，（如何是voc2007数据集会生成2007_train.txt和2007_val.txt和2007_test.txt文件）之后VOCdevkit/VOC2012/labels/可以看到生成的标签文件
3、训练除了07测试集外的所有数据集，需要整合为一个大的训练list，在VOCdevkit同级的路径下执行：

cat 2007_train.txt 2007_val.txt 2012_*.txt > train.txt

就会生成train.txt文件
而我只训练voc2012，所以执行命令：cat 2012_*.txt > train.txt
4、修改 cfg/voc.data：（2、3行改为自己的路径：）

classes= 20
train  = /home/yuhui/下载/darknet-master-1/PascalVOC2012/2012_train.txt
valid  = /home/yuhui/下载/darknet-master-1/PascalVOC2012/2012_val.txt
names = data/voc.names
backup = /home/yuhui/下载/darknet-master-1/backup/    #backup是保存训练权重的文件夹，没有就在项目文件下建一个

5、使用kmeans.py聚类自己数据集的anchor。更改程序里面的txt训练文件名称，输出自己数据集anchor的txt文件。使用train.py进行训练。需要更改的是类别文件，anchor文件(还没搞明白)
还有一中办法是直接在项目文件下执行如下命令：

./darknet detector calc_anchors cfg/voc.data -num_of_clusters 9 -width 416 -height 416     
#运行上面代码即可得到聚类结果，如果想要更高分辨率的聚类效果，修改width和height即可，一定要是32的整数倍。

执行以上命令后会在项目文件夹下生成anchors.txt，然后用它替换yolov3-voc.cfg中的anchors值
6、在项目文件目录下载权重文件：

wget https://pjreddie.com/media/files/darknet53.conv.74    #下载失败了，百度网盘下的，就只要把darknet53.conv.74放项目文件下就好

7、开始训练：

./darknet detector train cfg/voc.data cfg/yolov3-voc.cfg darknet53.conv.74 -map

#后面可以加-map(应该是为了可视化，或者当你在终端中加上 -map 参数的时候，你就会看到mAP指标)

./darknet detector train cfg/voc.data cfg/yolov3-voc.cfg yolov3-voc_last.weights -map

#中断训练后在原有基础上再次训练（上次训练最后生成的权重文件要放项目文件下）

./darknet detector train cfg/voc.data cfg/yolov3-voc.cfg darknet53.conv.74 2>1 | tee visualization/train_yolov3.log -map

#可视化中间参数需要用到训练时保存的log文件（命令中的路径根据自己实际修改）（不好使竟然！！！）
于是换一个：

./darknet detector train cfg/voc.data cfg/yolov3-voc.cfg darknet53.conv.74 >log.txt -map    #训练时保存训练日志，运行此代码

补充：如果想要指定具体的gpu进行训练，可以使用-i来指定，比如我想使用索引为2的gpu进行训练，可以这样写：

./darknet detector train data/voc.data cfg/yolov3-voc.cfg darknet53.conv.74 -i 2 -map

#指定具体那块gpu训练（从第一块索引0，1，2）

8、测试 #文件中batch和subdivisions两项必须为1。

./darknet detector test  cfg/voc.data cfg/yolov3-voc.cfg weights/yolov3.weights data/dog.jpg    
#权重保存weights文件夹中（根据实际保存目录修改

）

./darknet detector test  cfg/voc.data cfg/yolov3-voc.cfg weights/yolov3-voc_1000.weights data/dog.jpg   
 #应该是迭代1000次后的权重，测试后发现效果很差劲

./darknet detector test  cfg/voc.data cfg/yolov3-voc.cfg backup/yolov3-voc_last.weights data/dog.jpg    
#应该是迭代1000次之后的权重，（但是竟然只迭代1800次后就可以测试，而且识别概率挺高的）

懂了懂了！！！原来是每迭代1000次更新保存一次权重

./darknet detector test  cfg/voc.data cfg/yolov3-voc.cfg backup/yolov3-voc_2000.weights data/dog.jpg    #迭代2000次后的权重测试
./darknet detector test  cfg/voc.data cfg/yolov3-voc.cfg backup/yolov3-voc_20000.weights    #批量测试图片
./darknet detector demo cfg/voc.data cfg/yolov3-voc.cfg backup/yolov3-voc_30000.weights test.mp4 -out_filename xxx.mp4    #保存视频文件不打印结果

9、如何输入检测结果文本，计算recall，map计算，：

./darknet detector valid <data_cfg> <test_cfg> <weights> <out_file>  
  # 生成测试结果，文件中batch和subdivisions两项必须为1。
./darknet detector valid cfg/voc.data cfg/yolov3-voc.cfg backup/yolov3-voc_best.weights out_file

结果生成在的results指定的目录下以开头的若干文件中，若没有指定results，那么默认为/results。
v如果出现以下问题，则说明在.data文件里面没有指定valid的路径，添加即可：

Couldn't open file: data/train.list       #报错
./darknet detector map cfg/voc.data cfg/yolov3.cfg backup/yolov3_best.weights    #计算AP值，查看我们模型的训练效果，运行此代码

#darknet-yolo训练数据集时加载不了图片，那很有可能是图片格式不对

4、yolov4搭建 #和v3差不多 ‍️‍️‍️

项目地址：https://github.com/AlexeyAB/darknet #现在下载项目文件（源码，下载完后可放主目录）

yolov4.weights:  权重百度云链接：链接：https://pan.baidu.com/s/1ILfTuUrQxtNBU5DdNw7hoQ  提取码：ffm8

若要在GPU上跑，要修改一些参数，darknetwen文件夹内的makefile文件修改：

GPU=1
CUDNN=1
OPENCV=１ # 如果安装了opencv则改为１,在中终端中执行sudo apt-get install libopencv-dev  即可
OPENMP=0
DEBUG=0
...
NVCC=/usr/local/cuda-10.2/bin/nvcc # 原为 NVCC = nvcc，cuda后面的紧跟自己的cuda版本，如cuda-9.0，cuda-10.0等
ARCH= -gencode arch=compute_75,code=sm_75 \   #算力改为75

改完之后再make一下，在测试:

./darknet detect cfg/yolov4.cfg yolov4.weights data/dog.jpg    #测试图片
./darknet detector demo cfg/coco.data cfg/yolov3.cfg yolov3.weights test.mp4    #v3测试视屏文件
./darknet detector demo cfg/coco.data cfg/yolov4.cfg yolov4.weights test.mp4    #v4测试视屏文件
 -out_filename xxx.mp4 >xxx.txt   # 保存+打印出结果
./darknet detector demo cfg/coco.data cfg/yolov4.cfg yolov4.weights test.mp4 -out_filename xxx.mp4 >xxx.txt    #保存+打印出结果
./darknet detector demo cfg/coco.data cfg/yolov4.cfg yolov4.weights test.mp4 -out_filename xxx.mp4    #保存不打印结果

include video_capturing + NMS + drawing_bboxes:

  ./darknet detector demo cfg/coco.data cfg/yolov4.cfg yolov4.weights test.mp4 -dont_show -ext_output

#官方给出的视屏检测命令，-dont_show是在训练中图像显示给隐藏了，，其中-ext_output是输出目标检测的坐标，后边写的test.mp4就是输入视频文件
exclude video_capturing + NMS + drawing_bboxes:

./darknet detector demo cfg/coco.data cfg/yolov4.cfg yolov4.weights test.mp4 -benchmark

yolov4的复现其实个v3没有什么区别，这就是大佬的厉害之处，yolov3可以完美对接上yolov4，如果你还想用yolov3来检测，那么同样只需要准备好v3的权重文件，然后将上面的命令改成v3即可运行：

./darknet detect cfg/yolov3.cfg yolov3.weights data/person.jpg

5、制作VOC数据集 ‍️‍️‍️

1.图片数据准备 ✍️✍️✍️
图片数据的获取可以自己用高清摄像机采集视频，然后对其进行抽帧，获得图片数据集视频>>图片；因为xml文件序号要与图片编号一一对应，这里文件重命名可以用代码完成序号重命名（00001,00002等）
命名方式

2.标注数据 ✍️✍️✍️
这里用的是比较常用的labelImg标注工具，每标注一张图片都会生成一个xml文件。labelImg可以去浏览器下载，这里给个我当时下载的链接labelImg下载
labelImg使用方法大家直接搜一下就可以了，很简单也很好用的工具，页面大概是这样
首先简单介绍一下这两种工具，labelimg工具主要用于在目标检测，而 labelme工具图像分割领域制作自己的数据集，我们可以用labelimg用于制作自己的数据集训练像YOLOv3和YOLOv4目标检测模型，而用labelme可以自己制作像MaskRCNN模型做图像分割训练需要的数据集。
标注完所有图像之后就可以查看标记结果了，注意这里我们进行标注时有两种标记数据的格式一种是PascalVoc,另外一种是YOLO，这里以常见的VOC数据集格式进行标注，最终得到以xml格式的标注数据。
labelimg标注完数据之后以.xml数据的格式进行保存，只能创建矩形框更加适用于目标检测制作数据集，如YOLO，而labelme以.json文件的数据格式进行保存，可以创建多种类型的边框进行标注，适用于图像分割，如MaskRcnn。

标注数据： ✍️✍️✍️
LabelImg软件下载：https://github.com/tzutalin/labelImg
（解压得到labelImg-master文件夹）
在Anaconda环境中切换到该文件夹目录，并且安装好依赖项：pyqt5和lxml；安装完成执行如下命令即可打开软件使用：

pip install pyqt5
pip install lxml
pyrcc5 -o resources.py resources.qrc
python labelImg.py    #若出现错误ModuleNotFoundError: No module named  'libs.resources'，将LabelImg-master中的resources.py复制到libs文件中

Open Dir打开图片文件夹目录，Create RectBox创建标注框，Ctrl-S保存xml文件至Annotations文件夹
标注准则：
1、尽可能把图片中包含的目标都标注完
2、不同类别要分开标注

3.创建VOC文件夹 ✍️✍️✍️
新建文件夹命名VOC2007，并且在VOC2007下新建Annotations，ImageSets和JPEGImages三个文件夹，在ImageSets文件夹下再建一个Main文件夹。Annotations里面放已经标注好的xml文件，JPEGImages里面放自己的图片数据（序号00001,00002，00003…）

对于已经存在于coco数据集80个种类之中的一类，就不要自己训练了，官网权重训练的很好了已经；
对于不存在coco数据集的一种，无视convert.py, 无视.cfg文件，不要预加载官方权重，直接用我的train.py代码进行训练就可以了。你预加载官方权重，再去训练一个全新的物种，个人认为是浪费资源完全没意义的

6、Keras/Tensorflow+python+yolo3训练自己的数据集 ✍️✍️✍️

问题： E tensorflow/core/grappler/optimizers/meta_optimizer.cc:502] remapper failed: Invalid argument: Subshape must have computed start >= end since stride is negative, but is 0 and 2 (computed from start 0 and end 9223372036854775807 over shape with rank 2 and stride-1)

RuntimeError: Attempted to use a closed Session.

如果还是提示“Couldn't open webcam or video”的话，把视频的路径改为完整路径应该就好了

7、keras ‍️‍️‍️

在使用keras时候报错Keyerror ‘acc'，这是一个keras版本问题，acc和accuracy本意是一样的，但是不同keras版本使用不同命名，因此需要更换。val_acc也是如此。
pydot出问题时换为pydotplus

8、训练数据集时注意事项 ‍️‍️‍️

由于本人的电脑显存较小，运行时报错了：ResourceExhaustedError
应该可以修改参数，完成，在yolo_v3训练时候，就是通过修改batchsize和epoch来实现。
存在问题：keras v3训练自己数据集，重复训练模型(执行train.py文件)，测试时出现识别不出的情况

9、防止过拟合 ‍️‍️‍️

防止过拟合的方法：
提前终止（当验证集上的效果变差的时候）
L1和L2正则化加权
soft weight sharing
dropout

机器学习中的贝叶斯网络：如何构建高效的风险预测模型 AI天才研究院 DeepSeek R1 &大数据AI人工智能大模型自然语言处理人工智能语言模型编程实践开发语言架构设计
作者：禅与计算机程序设计艺术文章目录机器学习中的贝叶斯网络：如何构建高效的风险预测模型1.背景介绍2.基本概念术语说明2.1马尔科夫随机场（MarkovRandomField）2.2条件随机场（ConditionalRandomField，CRF）2.3变量elimination算法2.4贝叶斯网络3.核心算法原理和具体操作步骤以及数学公式讲解3.1原理介绍1.贝叶斯网络基础2.贝叶斯网络构建风险
机器臂运动控制算法工程师面试道亦无名面试算法人工智能机器学习
大厂的经验总结：一、基础概念理解请解释机器臂运动学正解和逆解的概念，并分别说明其用途。正解：已知机器臂各关节的角度（或位移），通过运动学模型计算出机器臂末端执行器在笛卡尔空间中的位置和姿态。用途在于可以根据给定的关节驱动值，预测末端的实际位置，用于运动仿真、路径验证等，比如在工业生产前模拟机器臂的动作是否能准确到达加工位置。逆解：已知机器臂末端执行器在笛卡尔空间中的期望位置和姿态，求解出各关节应处
Java高并发容器的内核解析：从无锁算法到分段锁的架构演进猿享天开开发语言 java
《Java高并发容器的内核解析：从无锁算法到分段锁的架构演进》本文将以JUC包核心容器为切入点，深入剖析ConcurrentHashMap在Java8中的64位Hash分段技术，解密LinkedBlockingQueue双锁队列设计的吞吐量秘密，并给出各容器在亿级流量场景下的性能压测对比与选型决策矩阵。一、BlockingQueue体系：生产者-消费者模式的工业级实现1.阻塞队列的四大行为矩阵行为
AI进化论：从图灵测试到智能革命的临界点 A达峰绮人工智能数据处理经验分享 AIGC AI人工智能
智能觉醒的起源密码（1943-2010）在曼彻斯特维多利亚大学的实验室里，1948年"Baby"计算机完成人类首个存储程序运行实验时，艾伦·图灵正在构思《计算机器与智能》。这篇划时代论文提出的"模仿游戏"测试，为人工智能奠定了哲学基础。1956年达特茅斯会议上，麦卡锡正式提出"人工智能"概念，当时学界乐观预测"二十年内机器将完成人类所有工作"。神经网络的发展轨迹充满戏剧性：1958年罗森布拉特发明
AI时代个人财富增长实战指南：从零基础到精通变现的完整路径 A达峰绮人工智能
（本文基于人工智能技术发展规律，结合互联网经济底层逻辑，为普通从业者构建系统性AI应用框架）一、建立AI认知基础：技术理解与工具掌握技术分类认知人工智能工具分为四大功能模块：自然语言处理（文本生成、对话交互）、计算机视觉（图像视频处理）、数据分析（预测建模）、自动化控制（流程优化）。建议新手首先掌握语言类工具的基础操作，逐步扩展到其他领域。工具操作逻辑通用AI工具通常包含三大核心功能模块：输入界面
【北上广深杭大厂AI算法面试题】计算机视觉篇...如何解决多尺度问题？努力毕业的小土博^_^ AI算法题库人工智能算法计算机视觉深度学习神经网络
【北上广深杭大厂AI算法面试题】计算机视觉篇…如何解决多尺度问题？【北上广深杭大厂AI算法面试题】计算机视觉篇…如何解决多尺度问题？文章目录【北上广深杭大厂AI算法面试题】计算机视觉篇...如何解决多尺度问题？前言数据级别的多尺度模型架构上的多尺度表示FPN代码示例（PyTorch）说明其他多尺度处理方法总结欢迎铁子们点赞、关注、收藏！祝大家逢考必过！逢投必中！上岸上岸上岸！upupup大多数高校
【大模型书籍PDF】从零开始大模型开发与微调：基于PyTorch与ChatGLM （推荐）_从零开始大模型开发与微调 pdf 喝不喝奶茶丫 pytorch 人工智能语言模型大模型转行大模型 AI大模型微调
今天又来给大家推荐一本大模型方面的书籍。本书使用PyTorch2.0作为学习大模型的基本框架，以ChatGLM为例详细讲解大模型的基本理论、算法、程序实现、应用实战以及微调技术，为读者揭示大模型开发技术。本书配套示例源代码、PPT课件。（书籍分享）
大语言模型学习路线：从入门到实战大模型官方资料语言模型学习人工智能产品经理自然语言处理搜索引擎
大语言模型学习路线：从入门到实战在人工智能领域，大语言模型（LargeLanguageModels,LLMs）正迅速成为一个热点话题。本学习路线旨在为有基本Python编程和深度学习基础的学习者提供一个清晰、系统的大模型学习指南，帮助你在这一领域快速成长。本学习路线更新至2024年02月，后期部分内容或工具可能需要更新。适应人群已掌握Python基础具备基本的深度学习知识学习步骤本路线将通过四个核
深度学习与目标检测系列(六) 本文约(4.5万字) | 全面解读复现ResNet | Pytorch | 小酒馆燃着灯深度学习目标检测 pytorch 人工智能 ResNet 残差连接残差网络
文章目录解读Abstract—摘要翻译精读主要内容Introduction—介绍翻译精读背景RelatedWork—相关工作ResidualRepresentations—残差表达翻译精读主要内容ShortcutConnections—短路连接翻译精读主要内容DeepResidualLearning—深度残差学习ResidualLearning—残差学习翻译精读ResNet目的以前方法本文改进本质
深度学习与目标检测系列(三) 本文约(4万字) | 全面解读复现AlexNet | Pytorch | 小酒馆燃着灯深度学习目标检测 pytorch AlexNet 人工智能
文章目录解读Abstract-摘要翻译精读主要内容1.Introduction—前言翻译精读主要内容：本文主要贡献：2.TheDataset-数据集翻译精读主要内容：ImageNet简介：图像处理方法：3.TheArchitecture—网络结构3.1ReLUNonlinearity—非线性激活函数ReLU翻译精读传统方法及不足本文改进方法本文的改进结果3.2TrainingonMultipleG
软考系统架构设计师考试学习和考试的知识点大纲，覆盖所有考试考点 DKPT #系统架构设计师系统架构学习
以下是软考系统架构设计师考试的知识点大纲，覆盖所有官方考点，分为基础知识、核心技术、系统设计、案例分析、论文写作五大模块，帮助系统性学习和备考：一、基础知识模块计算机组成与体系结构计算机硬件组成（CPU、内存、I/O设备）存储系统（Cache、RAID、虚拟内存）指令系统与流水线技术操作系统进程与线程管理（调度算法、死锁）内存管理（分页、分段、虚拟内存）文件系统与磁盘管理数据库系统关系数据库（SQ
单调栈详解【C/C++】ん贤算法单调栈算法 c++数据结构贪心算法
前言：了解过单调队列后，你会发现单调栈的思想其实挺简单...当然前提是要了解一下什么是栈(stack)。看待一个问题，从不同角度，也许能有不同的收获。在数学家眼中，单调栈本质上是一个严格或非严格维护的单调递增或单调递减的数学结构。其核心在于动态的维护动态递增或递减的有序关系。而对于算法工程师，他们首先关注单调栈的核心优势：O(n)的时间复杂度。在需要遍历序列，并纪录极值的情况下（如接雨水、每日温度
Caffeine vs Guava Cache：性能巅峰对决，谁才是 Java 本地缓存之王？ Julian.zhou Java 开发基础技能缓存 java 算法
CaffeinevsGuavaCache：性能巅峰对决，谁才是Java本地缓存之王？导语：在Java本地缓存的战场上，Caffeine和GuavaCache是开发者最常用的两大神器。但究竟谁的性能更胜一筹？为何Caffeine被称为“GuavaCache的终结者”？本文通过算法原理、并发性能、内存管理、实战测试四大维度，彻底揭秘两者的性能差异，文末附迁移指南和选型建议！一、核心差异：算法与淘汰策略
122. 买卖股票的最佳时机 II 请向我看齐 LeetCode 算法
题目分析LeetCode第122题是“买卖股票的最佳时机II”。题目描述为：给定一个数组prices，其中prices[i]是一支给定股票第i天的价格。设计一个算法来计算你所能获取的最大利润。你可以尽可能地完成更多的交易（多次买卖一支股票）。模式识别本题属于动态规划或者贪心算法的范畴。由于可以进行多次交易，且没有交易次数限制，所以可以通过比较相邻两天的价格，只要后一天价格比前一天高，就进行一次交易
二分查找算法 WH牛算法算法
目录1.二分查找算法的介绍1.1算法思路1.2算法模版1.2.1查找区间左端点1.2.1查找区间右端点2.模版题2.1数的范围2.2数的三次方根3.典题3.1机器人跳跃问题3.2分巧克力4.课后题1.二分查找算法的介绍1.1算法思路假设目标值在闭区间[l,r]中，每次将区间长度缩小一半，当l=r时，我们就找到了目标值。说人话：就是把答案所在的区间逐渐缩小，直到区间内只有答案。二分查找算法的时间复杂
景联文科技入选中国信通院发布的“人工智能数据标注产业图谱” 景联文科技科技人工智能
近日，由中国信息通信研究院、中国人工智能产业发展联盟牵头，联合中国电信集团、沈阳市数据局、保定高新区等70多家单位编制完成并发布《人工智能数据标注产业图谱》。景联文科技作为人工智能产业关键环节的代表企业，入选图谱中技术服务板块。图谱按照国家数据局技术创新、行业赋能、生态培育、标准应用、人才就业、数据安全等六个方面任务展开，由上游资源提供方、中游数据标注核心服务方、下游配套支撑方三部分组成。其中上游
搜广推校招面经五十四 Y1nhl 搜广推面经搜索算法 python 推荐算法机器学习人工智能
美团推荐算法一、手撕Transformer的位置编码1.1.位置编码的作用Transformer模型没有显式的序列信息（如RNN的循环结构），因此需要通过位置编码（PositionalEncoding）为输入序列中的每个位置添加位置信息。位置编码的作用是：提供序列位置信息：帮助模型理解输入序列中元素的顺序。保持唯一性和连续性：确保每个位置的位置编码是唯一的，且相邻位置的位置编码是连续的。1.2.位
搜广推校招面经五十三 Y1nhl 搜广推面经 python 机器学习人工智能推荐算法搜索算法算法
小红书推荐算法一、ESMM(EntireSpaceMulti-TaskModel)ESMM（EntireSpaceMulti-TaskModel）是一种用于解决推荐系统中多任务学习问题的模型。它由阿里巴巴团队提出，主要用于处理点击率（CTR）和转化率（CVR）的联合预测问题。1.1.背景在推荐系统中，CTR和CVR是两个重要的指标：CTR（Click-ThroughRate）：用户点击广告的概率。
EnerVerse：智元机器人提出首个机器人4D世界模型，在动作规划任务中达到SOTA水平强化学习曾小健机器人
EnerVerse：智元机器人提出首个机器人4D世界模型，在动作规划任务中达到SOTA水平PNP机器人PNP机器人2025年02月10日21:04上海本文来自：公众号智元机器人https://sites.google.com/view/enerverse，出于学术/技术分享进行转载，如有侵权，联系删文。EnerVerse的科研核心团队由智元机器人研究院的具身算法精英组成。黄思渊，作为上海交通大学与
使用 Milvus 进行向量数据库管理与实践 qahaj milvus 数据库 python
技术背景介绍在当今的AI与机器学习应用中，处理和管理大量的嵌入向量是一个常见的需求。Milvus是一个开源向量数据库，专门用于存储、索引和管理深度神经网络以及其他机器学习模型生成的大规模嵌入向量。它的高性能和易用性使其成为处理向量数据的理想选择。核心原理解析Milvus的核心功能体现在其强大的向量索引和搜索能力。它支持多种索引算法，包括IVF、HNSW等，使其能够高效地进行大规模向量的相似性搜索操
【IT大学生必会的】 10 种图表线性回归 .Boss. 深度学习开发语言人工智能机器学习算法
这段时间，不少同学提到了一些图表的问题。每次在使用matplotlib画图，运用这些图表说明问题的时候，很多时候是模糊的，比如说什么时候画什么图合适？其实这个根据你自己的需求，自己的想法来就行。今天的话，我这里举例在线性回归中，最常用的一些图表，应该可以cover绝大多数情况了。其他算法模型适用的图表，咱们在后面再给大家进行总结~至于数据集，表现方式，大家可以根据我给出的代码继续调整即可！那么，在
物理学不存在了？诺贝尔物理学奖颁给了人工智能资讯新鲜事人工智能
2024年10月8日，瑞典皇家科学院宣布，将2024年诺贝尔物理学奖授予美国普林斯顿大学教授约翰·J·霍普菲尔德（JohnJ.Hopfield）和加拿大多伦多大学教授杰弗里·E·辛顿（GeoffreyE.Hinton），以表彰他们“在人工神经网络机器学习方面的基础性发现和发明”。辛顿在接受电话采访时表示：“完全没想到”。实话实说，在结果出来前，大家也都没想到。因为在外界预测里，今年的诺贝尔物理学奖
分布式限流方案：基于 Redis 的令牌桶算法实现代码怪兽大作战后端分布式 redis 算法 java 令牌桶接口限流
分布式限流方案：基于Redis的令牌桶算法实现前言一、原理介绍：令牌桶算法二、分布式限流的设计思路三、代码实现四、方案优缺点五、适用场景总结前言在分布式场景下，接口限流变得更加复杂。传统的单机限流方式难以满足跨节点的限流需求，因此需要一种分布式限流方案。这里介绍一种基于Redis和Redisson实现的令牌桶算法分布式限流方案。一、原理介绍：令牌桶算法令牌桶算法是一种用于控制流量的经典算法，其基本
http与https的区别哥谭居民0001 网络安全服务器
加密方式：加密技术是对信息进行编码和解码的技术，编码是把原来可读信息（又称明文）译成代码形式（又称密文），其逆过程就是解码（解密），加密技术的要点是加密算法，加密算法可以分为三类：对称加密，如AES基本原理：将明文分成N个组，然后使用密钥对各个组进行加密，形成各自的密文，最后把所有的分组密文进行合并，形成最终的密文。优势：算法公开、计算量小、加密速度快、加密效率高缺陷：双方都使用同样密钥，安全性得
基于32单片机的无人机直流电机闭环调速系统设计赵谨言论文毕业设计经验分享
标题:基于32单片机的无人机直流电机闭环调速系统设计内容:1.摘要本文针对无人机直流电机调速需求，设计了基于32单片机的无人机直流电机闭环调速系统。背景在于无人机应用场景不断拓展，对电机调速精度和稳定性要求日益提高。目的是开发一套高精度、响应快的闭环调速系统，以提升无人机飞行性能。方法上，采用32单片机作为控制核心，结合编码器反馈电机转速信息，运用PID控制算法实现闭环调速。通过实验测试，结果表明
今日行情明日机会——20250321 人大博士的交易之路人工智能区块链数学建模数据挖掘分类涨停回马枪大数据
后续投资机会分析结合2025年3月21日盘面数据（涨停56家，跌停31家），市场呈现结构性分化行情，海洋经济成为绝对主线，机器人概念局部活跃，人工智能表现较弱。以下是具体方向与策略建议：1.海洋经济（核心主线，政策+事件驱动）核心逻辑：板块23家涨停，梯队完整（七板至一板），神开股份（七板）打开高度，叠加海洋资源开发、碳中和政策（如海上风电、深海装备）催化，资金深度介入。大连重工（三板，海洋工程装
人工智能革命：技术演进图谱与人类文明重构路径 A达峰绮人工智能重构经验分享图形绘制数据处理 AI
当GPT-4在2023年3月通过注册会计师考试时，其财务分析模块展现的推理能力已超越85%的人类考生。这个标志性事件背后，折射出人工智能正在突破认知型工作的最后防线。我们正在见证的，不仅是技术迭代，更是人类文明范式的根本性转变。一、算力奇点降临：AI基础设施的指数级进化量子计算与神经形态芯片的融合正在重塑算力边界。IBM最新数据显示，其量子体积（QuantumVolume）从2020年的64跃升至
蓝桥杯动态规划实战：从数字三角形到砝码称重藍海琴泉蓝桥杯动态规划职场和发展
适合人群：蓝桥杯备考生|算法竞赛入门者|DP学习实践者目录一、我的动态规划入门之路1.数字三角形：经典DP首战告捷2.砝码称重：背包问题的变形二、蓝桥杯高频算法考点三、蓝桥杯DP专项训练题四、备考建议一、我的动态规划入门之路1.数字三角形：经典DP首战告捷题目描述：从三角形的顶部到底部有很多条不同的路径。对于每条路径，把路径上面的数加起来可以得到一个和，你的任务就是找到最大的和（路径上的每一步只可
策略模式详解：实现灵活多样的支付方式 Dong雨策略模式 java
多支付方式的实现：策略模式详解策略模式（StrategyPattern）是一种行为设计模式，它定义了一系列算法，并将每个算法封装起来，使它们可以互换使用。策略模式使得算法可以独立于使用它的客户端变化。本文将通过一个具体的业务场景来介绍策略模式，并给出相应的代码实现。业务场景我们以一个电商平台为例，该平台支持多种支付方式，包括信用卡支付、PayPal支付和比特币支付。我们希望在不修改客户端代码的情况
蒙特卡罗树搜索算法依赖游戏树，也就是游戏的状态空间和可选动作的构成。游戏树是游戏设计者为了实现对战或博弈的目的 AI天才研究院 Python实战自然语言处理人工智能语言模型编程实践开发语言架构设计
作者：禅与计算机程序设计艺术1.简介20世纪末到21世纪初，计算机科学和互联网科技迅速发展。在这些新兴领域中，蒙特卡罗方法是一个显著的研究热点。蒙特卡罗方法源自物理学和数学领域，其目的是模拟物理系统的随机运动，从而解决很多数学、物理等领域的问题。蒙特卡loor方法被广泛应用于各类模拟、预测、优化、控制等领域。在计算机领域，蒙特卡罗方法也扮演了重要角色。现如今，计算性能已经足够强大，人们可以轻松地进
如何用ruby来写hadoop的mapreduce并生成jar包 wudixiaotie mapreduce
ruby来写hadoop的mapreduce，我用的方法是rubydoop。怎么配置环境呢： 1.安装rvm：不说了网上有 2.安装ruby：由于我以前是做ruby的，所以习惯性的先安装了ruby，起码调试起来比jruby快多了。 3.安装jruby： rvm install jruby然后等待安
java编程思想 -- 访问控制权限百合不是茶 java 访问控制权限单例模式
访问权限是java中一个比较中要的知识点,它规定者什么方法可以访问,什么不可以访问一:包访问权限; 自定义包: package com.wj.control; //包 public class Demo { //定义一个无参的方法 public void DemoPackage(){ System.out.println("调用
[生物与医学]请审慎食用小龙虾 comsci 生物
现在的餐馆里面出售的小龙虾,有一些是在野外捕捉的,这些小龙虾身体里面可能带有某些病毒和细菌,人食用以后可能会导致一些疾病,严重的甚至会死亡..... 所以,参加聚餐的时候,最好不要点小龙虾...就吃养殖的猪肉,牛肉,羊肉和鱼,等动物蛋白质
org.apache.jasper.JasperException: Unable to compile class for JSP: 商人shang maven 2.2 jdk1.8
环境： jdk1.8 maven tomcat7-maven-plugin 2.0 原因： tomcat7-maven-plugin 2.0 不知吃 jdk 1.8，换成 tomcat7-maven-plugin 2.2就行，即 <plugin>
你的垃圾你处理掉了吗?GC oloz GC
前序:本人菜鸟，此文研究学习来自网络，各位牛牛多指教　 1.垃圾收集算法的核心思想　　Java语言建立了垃圾收集机制，用以跟踪正在使用的对象和发现并回收不再使用(引用)的对象。该机制可以有效防范动态内存分配中可能发生的两个危险：因内存垃圾过多而引发的内存耗尽，以及不恰当的内存释放所造成的内存非法引用。　　垃圾收集算法的核心思想是：对虚拟机可用内存空间，即堆空间中的对象进行识别
shiro 和 SESSSION 杨白白 shiro
shiro 在web项目里默认使用的是web容器提供的session，也就是说shiro使用的session是web容器产生的，并不是自己产生的，在用于非web环境时可用其他来源代替。在web工程启动的时候它就和容器绑定在了一起，这是通过web.xml里面的shiroFilter实现的。通过session.getSession()方法会在浏览器cokkice产生JESSIONID，当关闭浏览器，此
移动互联网终端淘宝客如何实现盈利小桔子移動客戶端淘客淘寶App
2012年淘宝联盟平台为站长和淘宝客带来的分成收入突破30亿元，同比增长100%。而来自移动端的分成达1亿元，其中美丽说、蘑菇街、果库、口袋购物等App运营商分成近5000万元。可以看出，虽然目前阶段PC端对于淘客而言仍旧是盈利的大头，但移动端已经呈现出爆发之势。而且这个势头将随着智能终端(手机，平板)的加速普及而更加迅猛
wordpress小工具制作 aichenglong wordpress 小工具
wordpress 使用侧边栏的小工具，很方便调整页面结构小工具的制作过程 1 在自己的主题文件中新建一个文件夹(如widget)，在文件夹中创建一个php(AWP_posts-category.php) 小工具是一个类,想侧边栏一样，还得使用代码注册，他才可以再后台使用，基本的代码一层不变 <?php class AWP_Post_Category extends WP_Wi
JS微信分享 AILIKES js
// 所有功能必须包含在 WeixinApi.ready 中进行 WeixinApi.ready(function(Api) { // 微信分享的数据 var wxData = { &nb
封装探讨百合不是茶 JAVA面向对象封装
//封装属性方法将某些东西包装在一起，通过创建对象或使用静态的方法来调用，称为封装；封装其实就是有选择性地公开或隐藏某些信息，它解决了数据的安全性问题，增加代码的可读性和可维护性在 Aname类中申明三个属性，将其封装在一个类中：通过对象来调用例如 1： //属性将其设为私有姓名 name 可以公开
jquery radio/checkbox change事件不能触发的问题 bijian1013 JavaScript jquery
我想让radio来控制当前我选择的是机动车还是特种车，如下所示： <html> <head> <script src="http://ajax.googleapis.com/ajax/libs/jquery/1.7.1/jquery.min.js" type="text/javascript"><
AngularJS中安全性措施 bijian1013 JavaScript AngularJS 安全性 XSRF JSON漏洞
在使用web应用中，安全性是应该首要考虑的一个问题。AngularJS提供了一些辅助机制，用来防护来自两个常见攻击方向的网络攻击。一.JSON漏洞当使用一个GET请求获取JSON数组信息的时候（尤其是当这一信息非常敏感，
[Maven学习笔记九]Maven发布web项目 bit1129 maven
基于Maven的web项目的标准项目结构 user-project user-core user-service user-web src
【Hive七】Hive用户自定义聚合函数(UDAF) bit1129 hive
用户自定义聚合函数，用户提供的多个入参通过聚合计算(求和、求最大值、求最小值)得到一个聚合计算结果的函数。问题：UDF也可以提供输入多个参数然后输出一个结果的运算，比如加法运算add(3，5)，add这个UDF需要实现UDF的evaluate方法,那么UDF和UDAF的实质分别究竟是什么？ Double evaluate(Double a, Double b)
通过 nginx-lua 给 Nginx 增加 OAuth 支持 ronin47
前言：我们使用Nginx的Lua中间件建立了OAuth2认证和授权层。如果你也有此打算，阅读下面的文档，实现自动化并获得收益。SeatGeek 在过去几年中取得了发展，我们已经积累了不少针对各种任务的不同管理接口。我们通常为新的展示需求创建新模块，比如我们自己的博客、图表等。我们还定期开发内部工具来处理诸如部署、可视化操作及事件处理等事务。在处理这些事务中，我们使用了几个不同的接口来认证： &n
利用tomcat-redis-session-manager做session同步时自定义类对象属性保存不上的解决方法 bsr1983 session
在利用tomcat-redis-session-manager做session同步时，遇到了在session保存一个自定义对象时，修改该对象中的某个属性，session未进行序列化，属性没有被存储到redis中。在 tomcat-redis-session-manager的github上有如下说明： Session Change Tracking As noted in the &qu
《代码大全》表驱动法-Table Driven Approach-1 bylijinnan java 算法
关于Table Driven Approach的一篇非常好的文章： http://www.codeproject.com/Articles/42732/Table-driven-Approach package com.ljn.base; import java.util.Random; public class TableDriven { public
Sybase封锁原理 chicony Sybase
昨天在操作Sybase IQ12.7时意外操作造成了数据库表锁定，不能删除被锁定表数据也不能往其中写入数据。由于着急往该表抽入数据，因此立马着手解决该表的解锁问题。无奈此前没有接触过Sybase IQ12.7这套数据库产品，加之当时已属于下班时间无法求助于支持人员支持，因此只有借助搜索引擎强大的
java异常处理机制 CrazyMizzz java
java异常关键字有以下几个，分别为 try catch final throw throws 他们的定义分别为 try： Opening exception-handling statement. catch： Captures the exception. finally： Runs its code before terminating
hive 数据插入DML语法汇总 daizj hive DML 数据插入
Hive的数据插入DML语法汇总1、Loading files into tables语法：1) LOAD DATA [LOCAL] INPATH 'filepath' [OVERWRITE] INTO TABLE tablename [PARTITION (partcol1=val1, partcol2=val2 ...)]解释：1)、上面命令执行环境为hive客户端环境下： hive>l
工厂设计模式 dcj3sjt126com 设计模式
使用设计模式是促进最佳实践和良好设计的好办法。设计模式可以提供针对常见的编程问题的灵活的解决方案。工厂模式工厂模式（Factory）允许你在代码执行时实例化对象。它之所以被称为工厂模式是因为它负责“生产”对象。工厂方法的参数是你要生成的对象对应的类名称。 Example #1 调用工厂方法（带参数） <?phpclass Example{
mysql字符串查找函数 dcj3sjt126com mysql
FIND_IN_SET(str,strlist) 假如字符串str 在由N 子链组成的字符串列表strlist 中，则返回值的范围在1到 N 之间。一个字符串列表就是一个由一些被‘,’符号分开的自链组成的字符串。如果第一个参数是一个常数字符串，而第二个是type SET列，则 FIND_IN_SET() 函数被优化，使用比特计算。如果str不在strlist 或st
jvm内存管理 easterfly jvm
一、JVM堆内存的划分分为年轻代和年老代。年轻代又分为三部分：一个eden,两个survivor。工作过程是这样的：e区空间满了后，执行minor gc，存活下来的对象放入s0, 对s0仍会进行minor gc，存活下来的的对象放入s1中，对s1同样执行minor gc，依旧存活的对象就放入年老代中；年老代满了之后会执行major gc，这个是stop the word模式，执行
CentOS-6.3安装配置JDK-8 gengzg centos
JAVA_HOME=/usr/java/jdk1.8.0_45 JRE_HOME=/usr/java/jdk1.8.0_45/jre PATH=$PATH:$JAVA_HOME/bin:$JRE_HOME/bin CLASSPATH=.:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar:$JRE_HOME/lib export JAVA_HOME
【转】关于web路径的获取方法 huangyc1210 Web 路径
假定你的web application 名称为news,你在浏览器中输入请求路径： http://localhost:8080/news/main/list.jsp 则执行下面向行代码后打印出如下结果： 1、 System.out.println(request.getContextPath()); //可返回站点的根路径。也就是项
php里获取第一个中文首字母并排序远去的渡口数据结构 PHP
很久没来更新博客了，还是觉得工作需要多总结的好。今天来更新一个自己认为比较有成就的问题吧。最近在做储值结算，需求里结算首页需要按门店的首字母A-Z排序。我的数据结构原本是这样的： Array ( [0] => Array ( [sid] => 2885842 [recetcstoredpay] =&g
java内部类 hm4123660 java 内部类匿名内部类成员内部类方法内部类
　在Java中，可以将一个类定义在另一个类里面或者一个方法里面，这样的类称为内部类。内部类仍然是一个独立的类，在编译之后内部类会被编译成独立的.class文件，但是前面冠以外部类的类名和$符号。内部类可以间接解决多继承问题,可以使用内部类继承一个类，外部类继承一个类，实现多继承。 &nb
Caused by: java.lang.IncompatibleClassChangeError: class org.hibernate.cfg.Exten zhb8015
maven pom.xml关于hibernate的配置和异常信息如下，查了好多资料，问题还是没有解决。只知道是包冲突，就是不知道是哪个包....遇到这个问题的分享下是怎么解决的。。 maven pom: <dependency> <groupId>org.hibernate</groupId> <ar
Spark 性能相关参数配置详解－任务调度篇 Stark_Summer spark cache cpu 任务调度 yarn
随着Spark的逐渐成熟完善, 越来越多的可配置参数被添加到Spark中来, 本文试图通过阐述这其中部分参数的工作原理和配置思路, 和大家一起探讨一下如何根据实际场合对Spark进行配置优化。由于篇幅较长，所以在这里分篇组织，如果要看最新完整的网页版内容，可以戳这里：http://spark-config.readthedocs.org/，主要是便
css3滤镜 wangkeheng html css
经常看到一些网站的底部有一些灰色的图标，鼠标移入的时候会变亮，开始以为是js操作src或者bg呢，搜索了一下，发现了一个更好的方法：通过css3的滤镜方法。 html代码： <a href='' class='icon'><img src='utv.jpg' /></a> css代码： .icon{-webkit-filter: graysc