Skies_

（十七）论文阅读 | 目标检测之YOLOv4

简介

图1：论文原文

${\rm YOLOv4}$ 是继 ${\rm YOLOv3}$ 之后提出的又一高性能目标检测算法。 ${\rm YOLOv3}$ 凭借其结构简单、便于实现、实时性好、精度高等特点，在实际中被广泛应用。 ${\rm YOLO}$ 系列是一阶段目标检测方法的代表，而 ${\rm v3}$ 又是这一系列算法的代表，相比于 ${\rm YOLOv3}$ ， ${\rm YOLOv4}$ 在大幅提高精度的前提下保证了模型的实时性。
论文原文源码

在进行下面部分前，我们首先了解 ${\rm YOLOv3}$ 的相关内容。如下图（图来自这里）：

图2：YOLOv3

首先， ${\rm YOLOv3}$ 的特征提取部分使用的是 ${\rm DarkNet53}$ ，其结构如下图：

图3：Darknet53

${\rm DarkNet53}$ 的特点有：使用步长为 $2$ 的卷积操作代替池化；仅使用 $3 \times 3$ 和 $1 \times 1$ 的小卷积核；通过堆叠残差模块形成最终的网络结构（这也是现在很多模型采用的方法，即首先定义每一个块的结构，然后以合适的方式堆叠不同数量的块）。

其次，由于是一阶段算法， ${\rm YOLOv3}$ 直接回归目标的类别和边界框，如图 $2$ 中蓝色输出块所示，其共产生三种不同尺度的输出。其中，每一种尺度设置三种先验框，尺寸通过聚类得到。最后，给出实验结果对比图：

图4：YOLOv3实验结果对比

0. Abstract

作者将 ${\rm YOLOv3}$ 结合大量 ${\rm tricks}$ ，在数据处理、特征提取、网络回归等方面进行改善，得到 ${\rm YOLOv4}$ 。实验结果为在 ${\rm MS\ COCO}$ 数据集上的 ${\rm AP}$ 为 ${\rm 43.5\%}$ ， ${\rm FPS}$ 为 ${\rm ～65(Tesla\ V100)}$ 。
论文贡献：（一）提出一个高性能的检测器，可以在 ${\rm 1080Ti}$ 或 ${\rm 2080Ti}$ 上训练该模型；（2）实验验证了大量针对目标检测的 ${\rm tricks}$ 的有效性；（3）改善优化方法，使模型更能适应于单 ${\rm GPU}$ 训练。

1. Introduction

${\rm YOLOv4}$ 的实验结果对比：

图5：YOLOv4实验结果对比

2. Related Work

由于论文涉及大量 ${\rm tricks}$ ，本文在相关工作部分列举出论文中使用的相关方法，而作者的实验都是基于这些方法的，具体可查阅相关论文。

2.1 Object Detection Models

目标检测方法有以下分类：

在 ${\rm GPU}$ 上运行的模型，该类模型的 ${\rm backbone}$ 包括 ${\rm VGG}$ 、 ${\rm ResNet}$ 、 ${\rm ResNeXt}$ 、 ${\rm DenseNet}$ 等；
在 ${\rm CPU}$ 上运行的模型，该类模型的 ${\rm backbone}$ 包括 ${\rm SqueezeNet}$ 、 ${\rm MobileNet}$ 、 ${\rm ShuffleNet}$ 等；
两阶段检测方法，包括 ${\rm RCNN}$ 系列、 ${\rm R–FCN}$ 、 ${\rm Libra\ R–CNN}$ 等；
一阶段检测方法，包括 ${\rm YOLO}$ 系列、 ${\rm SSD}$ 、 ${\rm RetinaNet}$ 等；
两阶段无框检测方法，包括 ${\rm RepPoints}$ 等；
一阶段无框检测方法，包括 ${\rm CenterNet}$ 、 ${\rm CornerNet}$ 、 ${\rm FCOS}$ 等；
模型的颈（ ${\rm neck}$ ）包括 ${\rm FPN}$ 、 ${\rm PAN}$ 、 ${\rm BiPAN}$ 、 ${\rm NAS–FPN}$ 等；

其他包括 ${\rm DetNet}$ 、 ${\rm DetNAS}$ 、 ${\rm SpineNet}$ 、 ${\rm HitDetector}$ 等。

2.2 Bag of Freebies

目标检测模型通常以离线的方式训练（针对整体数据集进行训练，即先使用全部数据集训练模型，再使用模型；相对比的是在线训练，即边训练边使用模型的实时训练方式），研究者通常致力于设计更有效的训练方法，对于目标检测常用的是数据增强( ${\rm Data\ Augmentation}$ )。数据增强的目的是增加输入图像的多样性，以增强模型针对不同场景的鲁棒性。
首先，常用的数据增强方法包括亮度变化（亮度、对比度、明度、饱和度、噪声等）、几何变换（缩放、裁剪、旋转等）。上述方法都是像素级调整，调整后原始像素的信息得以保留。此外还有其他种类方法：随机擦除和 ${\rm CutOut}$ 等随机地将图像中的矩形区域用随机或特定像素值填充； ${\rm MixUp}$ 和 ${\rm CutMix}$ 等同时使用融合多幅图像进行增强；将 ${\rm GAN}$ 的方法应于图像增强等。
其次，不同于上述方法，还有通过增强数据集的语义信息的方法，这类方法往往解决的是样本不平衡问题。难例负样本挖掘和 ${\rm OHEM}$ 是两阶段检测方法中常用的方法，以及在一阶段检测方法中常使用的 ${\rm Focal\ Loss}$ 。此外，还有 ${\rm Label\ Smoothing}$ 用于提高模型鲁棒性、使用知识蒸馏设计标签精细化网络等。
最后是关于回归网络的目标函数设计。传统使用的是均方根误差（ ${\rm MSE}$ ），它直接对边界框的中心点以及宽、高或左上角顶点及右下角顶点回归。但这类方法仅独立地关注边界框属性，没有利用其整体信息。为了解决上述问题，又出现了 ${\rm IoU\ Loss}$ ，以及 ${\rm GIoU}$ 、 ${\rm DIoU}$ 、 ${\rm CIoU}$ 等改进。

2.3 Bag of Specials

目标检测模型中通常采用特定的模块以增大感受野、引入注意力机制、增强特征融合等，以及某些后处理手段是筛选模型的有效方法。首先，常用的用于增大感受野的方法有 ${\rm SPP}$ 、 ${\rm ASPP}$ 、 ${\rm RFB}$ 。其次，目标检测中常用到的注意力模块是通道注意力和点注意力，二者的代表分别是 ${\rm SE}$ 和 ${\rm SAM}$ 。最后，对于特征融合模块，常用到的有 ${\rm SFAM}$ 、 ${\rm ASFF}$ 、 ${\rm BiFPN}$ 等。
此外，还有许多关于对激活函数的研究， ${\rm ReLU}$ 是常用的激活函数，及对它的改进有 ${\rm LReLU}$ 、 ${\rm PReLU}$ 、 ${\rm ReLU6}$ 、 ${\rm SELU}$ 、 ${\rm Swish}$ 、 ${\rm hard–Swish}$ 等。
常用的后处理模块是 ${\rm NMS}$ ，它的作用是过滤掉某些高置信度的错误预测结果，及对它的改进有 ${\rm soft–}$ ${\rm NMS}$ 、 ${\rm DIOU\ NMS}$ 等。

3. Methodolody

3.1 Selection of Architecture

作者在设计网络结构时的原则是尽量平衡输入图像分辨率、卷积层数、模型参数、卷积核数。作者通过大量实验对比，最后选择 ${\rm CSPDarkNet53}$ 作为模型的特征提取网络（ ${\rm CSPDarkNet53}$ 源自 ${\rm CSPNet}$ 和 ${\rm DarkNet53}$ ）。下图展示了几种模型的参数对比：

图6：几种模型的参数对比

此外， ${\rm YOLOv4}$ 使用 ${\rm SPP}$ 模块以增大感受野、使用 ${\rm PANet}$ 作为特征融合模块，以及使用 ${\rm YOLOv3}$ 的检测头。

3.2 Selection of BoF and BoS

本部分对应于上述 $(2.2)$ 和 $(2.3)$ 部分。

3.3 Additional Improvements

为了使得模型可以更适用于在单 ${\rm GPU}$ 上训练，作者对模型进行如下改善：

提出新的数据增强方法，包括 ${\rm Mosaic}$ 和自对抗训练（ ${\rm Self\ Adversarial\ Training,SAT}$ ）；
使用遗传算法的同时使用最佳超参数；
对 ${\rm SAM}$ 、 ${\rm PAN}$ 和 ${\rm BN}$ 改进。

${\rm Mosaic}$ 的思路是将 $4$ 张图像融合，这就使得结果包含 $4$ 种不同的上下文信息（如图 $7$ ）。自对抗训练是一

图7：Mosaic

种新的数据增强方法。在前向传播过程中，模型改变输入图像而非权重以使得网络进行自抗性攻击。在反向传播过程中，模型针对对抗样本进行训练。
${\rm CmBN}$ 是对 ${\rm BN}$ 的改进，它仅收集单个批次中小批数据间的信息，如下图：

图8：CmBN

论文将 ${\rm SAM}$ 中的空间注意力替换为点注意力；将 ${\rm PAN}$ 中的特征融合方式由相加改为拼接。

3.4 YOLOv4

最后，总结一下 ${\rm YOLOv4}$ 的各个部分： ${\rm YOLOv4}$ 由 ${\rm CSPDarkNet53}$ （ ${\rm Backbone}$ ）、 ${\rm SPP,PAN}$ （ ${\rm Neck}$ ）、 ${\rm YOLOv3}$ （ ${\rm Head}$ ）组成，用到的 ${\rm tricks}$ 包括：

对于 ${\rm backbone}$ 的 ${\rm BoF}$ ： ${\rm CutMix}$ 和 ${\rm Mosaic}$ 数据增强方法、 ${\rm DropBlock}$ 正则化、 ${\rm Label\ Smoothing}$ ；
对于 ${\rm backbone}$ 的 ${\rm BoS}$ ： ${\rm Mish}$ 激活函数、 ${\rm CSP}$ 、多输入加权残差连接（ ${\rm MiWRC}$ ）;
对于 ${\rm detector}$ 的 ${\rm BoF}$ ： ${\rm CIoU}$ 、 ${\rm CmBN}$ 、 ${\rm DropBlock}$ 正则化、 ${\rm Mosaic}$ 数据增强方法、自对抗训练、消除网络敏感性、多个 ${\rm anchor}$ 匹配一个标注框、余弦退火策略、最佳超参数、训练时随机尺寸；
对于 ${\rm detector}$ 的 ${\rm BoS}$ ： ${\rm Mish}$ 激活函数、 ${\rm SPP}$ 模块、 ${\rm SAM}$ 模块、 ${\rm PAN}$ 模块、 ${\rm DIoU–NMS}$ 模块。

4. Experiments

这里直接给出各目标检测模型的实验结果对比：

图9：目标检测模型实验结果对比

5. Conclusion

论文提出的 ${\rm YOLOv4}$ 在所有一阶段检测算法上表现 ${\rm SOTA}$ ，其通过综合各种有效的模块、加上合适的训练方法，得到一个高性能模型。此外， ${\rm YOLOv4}$ 可以在很多单 ${\rm GPU}$ 上训练，这表明模型的优化方面还是做得挺好的。
虽然 ${\rm YOLOv4}$ 的精度和速度表现较好，但模型综合了大量的 ${\rm tricks}$ ，可以预见到模型在训练过程中的收敛情况不如 ${\rm YOLOv3}$ 。此外，相比较于 ${\rm YOLOv3}$ ， ${\rm YOLOv4}$ 的模型更加复杂、训练元素更加繁多，这导致很多人不会将 ${\rm YOLOv4}$ 作为首选方案。构建一个结构简单、性能高效、训练方便的模型才是人们所追捧的， ${\rm YOLOv3}$ 和 ${\rm SSD}$ 在实际应用中的表现就印证了这一点。最后文中涉及大量论文的思想，具体某项技术的思想和实现可参考相应论文。

由于没有阅读源码，本文只总结了 ${\rm YOLOv4}$ 的大体结构和信息，详细内容请阅读论文原文。

参考

Redmon J, Farhadi A. Yolov3: An incremental improvement[J]. arXiv preprint arXiv:1804.02767, 2018.
Bochkovskiy A, Wang C Y, Liao H Y M. YOLOv4: Optimal Speed and Accuracy of Object Detection[J]. arXiv preprint arXiv:2004.10934, 2020.

完

你可能感兴趣的:(论文阅读)

【LLM论文阅读】一只齐刘海的猫论文阅读
LLM论文阅读论文重点论文链接RopeRoFormer:EnhancedTransformerwithRotaryPositionEmbeddingRoPE论文阅读YarnUnderstandingYaRN:ExtendingContextWindowofLLMs论文YaRN笔记T5ExploringtheLimitsofTransferLearningwithaUnifiedText-to-Te
Segment Anything in High Quality之SAM-HQ论文阅读 qq_41627642 深度学习论文阅读论文阅读
摘要最近的SegmentAnythingModel（SAM）在扩展分割模型规模方面取得了重大突破，具备强大的零样本能力和灵活的提示机制。尽管SAM在训练时使用了11亿个掩码，其掩码预测质量在许多情况下仍不理想，尤其是对于结构复杂的目标。我们提出了HQ-SAM，使SAM能够精确地分割任意目标，同时保留其原有的可提示设计、高效性和零样本泛化能力。我们的设计充分复用并保留了SAM预训练的模型权重，仅引入
yolov算法详解_yolo 目标检测算法个人总结（yolov1） CHAO JIANG yolov算法详解
yolo目标检测算法个人总结目前yolo目标检测有两个版本，分别为v1和v2。因工作需要用yolo算法检测人物，所以这段时间重点看了这两篇论文，并实现了对应的tensorflow代码。这里记录下在论文阅读过程中的一些细节信息，留给自己，同时也希望各位能指出本人理解错误的地方，谢谢！一：yolov1关于yolov1算法的详解在网上已经非常多了，在这里我大概叙述下算法的流程，以及在开发过程中遇到的一些
《论文阅读》GPT-3是否会产生移情对话？一种新的情境示例选择方法和用于生成同理心对话的自动评估度量 ICCL 2022 365JHWZGo 情感对话论文阅读 gpt-3 共情回复上下文学习提示学习大模型
《论文阅读》GPT-3是否会产生移情对话？一种新的情境示例选择方法和用于生成同理心对话的自动评估度量ICCL2022前言贡献PromptIn-contextlearningSITSMEMOSITSM新的自动指标实验前言亲身阅读感受分享，细节画图解释，再也不用担心看不懂论文啦~无抄袭，无复制，纯手工敲击键盘~今天为大家带来的是《DoesGPT-3GenerateEmpatheticDialogues
[论文阅读] 人工智能 + 软件工程 | 揭秘ChatGPT在软件开发问题解决中的有效性：一项实证研究张较瘦_ 前沿技术论文阅读人工智能软件工程
揭秘ChatGPT在软件开发问题解决中的有效性：一项实证研究论文：WhatMakesChatGPTEffectiveforSoftwareIssueResolution?AnEmpiricalStudyofDeveloper-ChatGPTConversationsinGitHubarXiv:2506.22390WhatMakesChatGPTEffectiveforSoftwareIssueRe
[论文阅读] 人工智能 + 软件工程 | 代码注释不一致问题研究：从数据革新到端到端解决方案张较瘦_ 前沿技术论文阅读人工智能软件工程
代码注释不一致问题研究：从数据革新到端到端解决方案原文：CCISOLVER:End-to-EndDetectionandRepairofMethod-LevelCode-CommentInconsistencyarXiv:2506.20558CCISolver:End-to-EndDetectionandRepairofMethod-LevelCode-CommentInconsistencyRe
Learning Fully Convolutional Networks for Iterative Non-blind Deconvolution论文阅读青铜锁00 #退化论文阅读深度学习论文阅读图像处理
LearningFullyConvolutionalNetworksforIterativeNon-blindDeconvolution1.研究目标与实际问题1.1研究目标1.2实际意义2.创新方法与模型设计2.1核心框架：迭代式梯度域处理2.1.1模型架构2.2关键技术实现2.2.1梯度域去噪网络2.2.2解卷积模块（核心公式实现）2.2.3损失函数设计2.2.4超参数端到端学习2.3与传统方法
KAIST数据集及使用草莓奶忻 SLAM基础 #SLAM数据集 ubuntu
文章目录KAIST复杂城市数据集KAIST数据集转换为rosbag1.将.gz.tar文件解压到其文件夹中2.克隆并构建此存储库3.使用路径和所需主题编辑配置文件4.为每种传感器类型创建一个rosbag文件5.将所有bag合并为一个参考KAIST复杂城市数据集KAIST-Urban-数据集-论文阅读数据集下载：ComplexUrbanDataset复杂城市数据集KAIST数据集转换为rosbag1
[论文阅读] 软件工程 | 需求工程中领域知识研究：系统映射与创新突破张较瘦_ 前沿技术论文阅读软件工程
需求工程中领域知识研究：系统映射与创新突破论文信息DomainKnowledgeinRequirementsEngineering:ASystematicMappingStudyarXiv:2506.20754DomainKnowledgeinRequirementsEngineering:ASystematicMappingStudyMarinaAraújo,JúliaAraújo,RomeuO
论文阅读：2025 arxiv Qwen3 Technical Report
https://arxiv.org/pdf/2505.09388https://www.doubao.com/chat/9918384373236738文章目录论文翻译Qwen3技术报告摘要1引言论文翻译Qwen3技术报告Qwen团队摘要在这项工作中，我们介绍了Qwen模型家族的最新版本Qwen3。Qwen3包含一系列大型语言模型（LLM），旨在提升性能、效率和多语言能力。Qwen3系列包括密集型
[论文阅读] 软件工程 | 探索软件生态系统中的开发者体验关键因素
探索软件生态系统中的开发者体验关键因素：从研究到实践引文格式@article{Zacarias2025,title={ExploringDeveloperExperienceFactorsinSoftwareEcosystems},author={Zacarias,RodrigoOliveiraandAntunes,L{\'e}oCarvalhoRamosandBarros,M{\'a}rciod
Fast Image Deconvolution using Hyper-Laplacian Priors论文阅读青铜锁00 #退化论文阅读论文阅读图像处理
FastImageDeconvolutionusingHyper-LaplacianPriors1.论文的研究目标与实际意义2.论文的创新方法2.1核心框架：交替最小化（AlternatingMinimization）2.2x子问题：频域FFT加速2.3w子问题：高效求解的核心创新2.3.1问题形式2.3.2查找表法（LUT）2.3.3解析解法（特定α\alphaα）2.3.4通用α\alphaα
[论文阅读] 人工智能 + 软件工程 | AI 与敏捷开发的破局之路：从挫败到成功的工作坊纪实张较瘦_ 前沿技术论文阅读人工智能软件工程
AI与敏捷开发的破局之路：从挫败到成功的工作坊纪实论文信息arXiv:2506.20159AIandAgileSoftwareDevelopment:FromFrustrationtoSuccess–XP2025WorkshopSummaryTomasHerda,VictoriaPichler,ZheyingZhang,PekkaAbrahamsson,GeirK.HanssenSubjects:
Diff-Retinex: Rethinking Low-light Image Enhancement with A Generative Diffusion Model 论文阅读钟屿论文阅读人工智能深度学习学习图像处理计算机视觉
Diff-Retinex：用生成式扩散模型重新思考低光照图像增强摘要本文中，我们重新思考了低光照图像增强任务，并提出了一种物理可解释的生成式扩散模型，称为Diff-Retinex。我们的目标是整合物理模型和生成网络的优点。此外，我们希望通过生成网络补充甚至推断低光照图像中缺失的信息。因此，Diff-Retinex将低光照图像增强问题表述为Retinex分解和条件图像生成。在Retinex分解中，我
【论文阅读】人工智能在直升机航空电子系统中的应用肥鼠路易论文阅读人工智能航空电子系统应用
人工智能在直升机航空电子系统中的应用论文摘要文章结构参考文献论文摘要论文摘要:在现代战争形势日趋信息化、智能化的背景下，将人工智能应用于武器装备已经是大势所趋。针对直升机飞行任务的特征，对其发展状况进行了描述，并对其作业能力进行了分析，探索了人工智能技术在直升机航电系统中的应用方向，为推进人工智能在直升机上的转化与应用奠定基础。通过对国外先进直升机智能技术的运用现状及对其作业能力的要求进行分析，探
[论文阅读] 人工智能+软件工程 | 用大语言模型架起软件需求形式化的桥梁张较瘦_ 前沿技术人工智能论文阅读软件工程
用大语言模型架起软件需求形式化的桥梁：一篇ACM调查草案的深度解读论文信息arXiv:2506.14627ACMSurveyDraftonFormalisingSoftwareRequirementswithLargeLanguageModelsArshadBeg,DiarmuidO’Donoghue,RosemaryMonahanComments:22pages.6summarytablesSu
Reti-Diff: Illumination Degradation Image Restoration with Retinex-based Latent Diffusion Model论文阅读青铜锁00 深度学习论文阅读 #退化论文阅读
Reti-Diff:IlluminationDegradationImageRestorationwithRetinex-basedLatentDiffusionModel1.研究目标与实际意义1.1研究目标1.2实际意义2.创新方法与模型设计2.1整体框架2.2RetinexPriorExtraction(RPE)模块2.2.1Retinex分解2.2.2先验压缩2.3Retinex-guide
SIMPL论文阅读 ZHANG8023ZHEN 论文阅读
论文链接：https://arxiv.org/pdf/2402.02519文章还没细看，但主要贡献点应该是SymmetricFusionTransformer和Bezier-basedMotionDecoder.对Bezier-basedMotionDecoder比较感兴趣，之后对这块细看一下
【论文阅读笔记】《CodeS: Towards Building Open-source Language Models for Text-to-SQL 》柠石榴 text2sql 论文论文阅读笔记语言模型
文章目录一、论文基本信息1.文章标题2.所属刊物/会议3.发表年份4.作者列表5.发表单位二、摘要三、解决问题四、创新点五、自己的见解和感想六、研究背景七、研究方法模型实验数据评估指标八、总结九、相关重要文献一、论文基本信息1.文章标题CodeS:TowardsBuildingOpen-sourceLanguageModelsforText-to-SQL2.所属刊物/会议未明确标注（会议缩写为“C
agentformer论文阅读 ZHANG8023ZHEN 论文阅读
参考了这篇博文：https://zhuanlan.zhihu.com/p/512764984主要有这几个部分a.map_encoderi.对地图进行CNNb.ContextEncoderi.timeencoder–将时间信息用transformer和positionemb进行融合，加入到特征中ii.agent-awareattention–self和selfattentionother和other
【论文阅读】DynamicControl ：一种新的controlnet多条件控制方法 prinTao pytorch Diffusion 论文阅读
背景现有方法要么处理条件效率低下，要么使用固定数量的条件，这并不能完全解决多个条件的复杂性及其潜在冲突。这强调了需要创新方法来有效管理多种条件，以实现更可靠和详细的图像合成。为了解决这个问题，我们提出了一个新的框架DynamicControl，它支持不同控制信号的动态组合，允许自适应选择不同数量和类型的条件。本文方法从一个双循环控制器开始，它通过利用预先训练的条件生成模型和判别模型为所有输入条件生
论文阅读：2018 arxiv CrowdHuman: A Benchmark for Detecting Human in a Crowd CSPhD-winston-杨帆论文阅读
https://www.doubao.com/chat/9226473480559618https://arxiv.org/pdf/1805.00123CrowdHuman:ABenchmarkforDetectingHumaninaCrowd文章目录论文翻译CrowdHuman：用于检测人群中人体的基准摘要1.引言2.相关工作2.1.人体检测数据集2.2.人体检测框架。论文翻译CrowdHuma
论文阅读：arxiv 2025 OThink-R1: Intrinsic Fast/Slow Thinking Mode Switching for Over-Reasoning Mitigation CSPhD-winston-杨帆论文阅读
总目录大模型安全相关研究：https://blog.csdn.net/WhiffeYF/article/details/142132328https://www.doubao.com/chat/8815924393371650https://arxiv.org/pdf/2506.02397#page=17.09OThink文章目录速览研究背景与问题核心思路与方法实验结果结论与意义速览这篇论文聚焦于
论文阅读：arxiv 2025 Not All Tokens Are What You Need In Thinking
总目录大模型安全相关研究：https://blog.csdn.net/WhiffeYF/article/details/142132328https://arxiv.org/pdf/2505.17827https://www.doubao.com/chat/8814790364572162文章目录速览研究背景提出的解决方案：条件token选择（CTS）实验结果核心贡献研究局限总结速览这篇论文主要探
[论文阅读]PIDNet: A Real-time Semantic Segmentation Network Inspired by PID Controllers 颜笑晏晏论文阅读
1.摘要双分支网络结构已显示出其对实时语义分割任务的效率性和有效性。然而，低级细节和高级语义的直接融合将导致细节特征容易被周围上下文信息淹没，即本文中的超调(overshoot)，这限制了现有两个分支模型的准确性的提高。在本文中，我们在卷积神经网络（CNN）和比例积分微分（PID）控制器之间架起了桥梁，并揭示了双分支网络只是一个比例积分（PI）控制器，当然也会存在类似的超调问题。为了解决这个问题，
[论文阅读] 人工智能+软件工程 | 用 LLM + 静态代码分析自动化提升代码质量张较瘦_ 前沿技术论文阅读人工智能软件工程
用LLM+静态代码分析自动化提升代码质量论文信息AugmentingLargeLanguageModelswithStaticCodeAnalysisforAutomatedCodeQualityImprovements@article{abtahi2025augmenting,title={AugmentingLargeLanguageModelswithStaticCodeAnalysisfo
经典论文阅读《A Framework for Unifying Reordering Transformations》《统一重排序变换的框架》好好学习啊天天向上自动性能优化
1）摘要我们提出了一个用于统一迭代重排序变换的框架，这些变换包括循环交换、循环分布、倾斜、分块、索引集拆分和语句重排序。该框架基于这样一种思想：变换可以表示为将原始迭代空间映射到新迭代空间的调度。框架旨在为变换提供一种统一的表示和推理方式。作为框架的一部分，我们提供了辅助构建和使用调度的算法，特别是用于检验调度合法性、对齐调度以及为调度生成优化代码的算法。2）优化编译器会对语句的迭代进行重新排序，
[论文阅读] 系统架构 | 零售 IT 中的微服务与实时处理：开源工具链与部署策略综述张较瘦_ 前沿技术论文阅读大数据零售
零售IT中的微服务与实时处理：开源工具链与部署策略综述论文信息MicroservicesandReal-TimeProcessinginRetailIT:AReviewofOpen-SourceToolchainsandDeploymentStrategiesAaditaaVashisht(DepartmentofInformationScienceandEngineering,RVCollege
[论文阅读]人工智能 | CoMemo：给大视觉语言模型装个“图像记忆” 张较瘦_ 前沿技术人工智能论文阅读语言模型
【论文速览】CoMemo：给大视觉语言模型装个“图像记忆”论文信息Liu,S.,Su,W.,Zhu,X.,Wang,W.,&Dai,J.(2025).CoMemo:LVLMsNeedImageContextwithImageMemory.arXivpreprintarXiv:2506.06279.一、研究背景：当LVLMs遇到“视觉健忘症”想象一下，你在阅读一本图文并茂的小说时，随着文字篇幅越来越
[论文阅读] 人工智能+软件工程 | 结对编程中的知识转移新图景张较瘦_ 前沿技术人工智能软件工程结对编程
当AI成为编程搭档：结对编程中的知识转移新图景论文信息论文标题：FromDeveloperPairstoAICopilots:AComparativeStudyonKnowledgeTransfer（从开发者结对到AI副驾驶：知识转移的对比研究）作者及机构：AlisaWelter等来自德国萨尔兰大学，ChristofTinnes同时隶属于西门子公司发表平台：arXiv预印本平台发表时间：2025年
js动画html标签（持续更新中） 843977358 html js 动画 media opacity
1.jQuery 效果 - animate() 方法改变 "div" 元素的高度： $(".btn1").click(function(){ $("#box").animate({height:"300px
springMVC学习笔记 caoyong springMVC
1、搭建开发环境 a>、添加jar文件，在ioc所需jar包的基础上添加spring-web.jar,spring-webmvc.jar b>、在web.xml中配置前端控制器 <servlet> &nbs
POI中设置Excel单元格格式 107x poi style 列宽合并单元格自动换行
引用：http://apps.hi.baidu.com/share/detail/17249059 POI中可能会用到一些需要设置EXCEL单元格格式的操作小结：先获取工作薄对象: HSSFWorkbook wb = new HSSFWorkbook(); HSSFSheet sheet = wb.createSheet(); HSSFCellStyle setBorder = wb.
jquery 获取A href 触发js方法的this参数无效的情况一炮送你回车库 jquery
html如下： <td class=\"bord-r-n bord-l-n c-333\"> <a class=\"table-icon edit\" onclick=\"editTrValues(this);\">修改</a> </td>" j
md5 3213213333332132 MD5
import java.security.MessageDigest; import java.security.NoSuchAlgorithmException; public class MDFive { public static void main(String[] args) { String md5Str = "cq
完全卸载干净Oracle11g sophia天雪 orale数据库卸载干净清理注册表
完全卸载干净Oracle11g A、存在OUI卸载工具的情况下：第一步：停用所有Oracle相关的已启动的服务；第二步：找到OUI卸载工具：在“开始”菜单中找到“oracle_OraDb11g_home”文件夹中 &
apache 的access.log 日志文件太大如何解决 darkranger apache
CustomLog logs/access.log common 此写法导致日志数据一致自增变大。直接注释上面的语法 #CustomLog logs/access.log common 增加： CustomLog "|bin/rotatelogs.exe -l logs/access-%Y-%m-d.log
Hadoop单机模式环境搭建关键步骤 aijuans 分布式
Hadoop环境需要sshd服务一直开启，故，在服务器上需要按照ssh服务，以Ubuntu Linux为例，按照ssh服务如下： sudo apt-get install ssh sudo apt-get install rsync 编辑HADOOP_HOME/conf/hadoop-env.sh文件，将JAVA_HOME设置为Java
PL/SQL DEVELOPER 使用的一些技巧 atongyeye java sql
1 记住密码这是个有争议的功能，因为记住密码会给带来数据安全的问题。但假如是开发用的库，密码甚至可以和用户名相同，每次输入密码实在没什么意义，可以考虑让PLSQL Developer记住密码。位置：Tools菜单－－Preferences－－Oracle－－Logon HIstory－－Store with password 2 特殊Copy 在SQL Window
PHP：在对象上动态添加一个新的方法 bardo 方法动态添加闭包
有关在一个对象上动态添加方法，如果你来自Ruby语言或您熟悉这门语言，你已经知道它是什么...... Ruby提供给你一种方式来获得一个instancied对象，并给这个对象添加一个额外的方法。好！不说Ruby了，让我们来谈谈PHP PHP未提供一个“标准的方式”做这样的事情，这也是没有核心的一部分... 但无论如何，它并没有说我们不能做这样
ThreadLocal与线程安全 bijian1013 java java多线程 threadLocal
首先来看一下线程安全问题产生的两个前提条件： 1.数据共享，多个线程访问同样的数据。 2.共享数据是可变的，多个线程对访问的共享数据作出了修改。实例：定义一个共享数据： public static int a = 0;
Tomcat 架包冲突解决征客丶 tomcat Web
环境： Tomcat 7.0.6 win7 x64 错误表象：【我的冲突的架包是：catalina.jar 与 tomcat-catalina-7.0.61.jar 冲突，不知道其他架包冲突时是不是也报这个错误】严重: End event threw exception java.lang.NoSuchMethodException: org.apache.catalina.dep
【Scala三】分析Spark源代码总结的Scala语法一 bit1129 scala
Scala语法 1. classOf运算符 Scala中的classOf[T]是一个class对象，等价于Java的T.class,比如classOf[TextInputFormat]等价于TextInputFormat.class 2. 方法默认值 defaultMinPartitions就是一个默认值，类似C++的方法默认值
java 线程池管理机制 BlueSkator java线程池管理机制
编辑 Add Tools jdk线程池一、引言第一：降低资源消耗。通过重复利用已创建的线程降低线程创建和销毁造成的消耗。第二：提高响应速度。当任务到达时，任务可以不需要等到线程创建就能立即执行。第三：提高线程的可管理性。线程是稀缺资源，如果无限制的创建，不仅会消耗系统资源，还会降低系统的稳定性，使用线程池可以进行统一的分配，调优和监控。
关于hql中使用本地sql函数的问题（问-答） BreakingBad HQL 存储函数
转自于：http://www.iteye.com/problems/23775 问：我在开发过程中，使用hql进行查询（mysql5）使用到了mysql自带的函数find_in_set()这个函数作为匹配字符串的来讲效率非常好，但是我直接把它写在hql语句里面（from ForumMemberInfo fm,ForumArea fa where find_in_set(fm.userId,f
读《研磨设计模式》-代码笔记-迭代器模式-Iterator bylijinnan java 设计模式
声明：本文只为方便我个人查阅和理解，详细的分析以及源代码请移步原作者的博客http://chjavach.iteye.com/ import java.util.Arrays; import java.util.List; /** * Iterator模式提供一种方法顺序访问一个聚合对象中各个元素，而又不暴露该对象内部表示 * * 个人觉得，为了不暴露该
常用SQL chenjunt3 oracle sql C++c C#
--NC建库 CREATE TABLESPACE NNC_DATA01 DATAFILE 'E:\oracle\product\10.2.0\oradata\orcl\nnc_data01.dbf' SIZE 500M AUTOEXTEND ON NEXT 50M EXTENT MANAGEMENT LOCAL UNIFORM SIZE 256K ; CREATE TABLESPA
数学是科学技术的语言 comsci 工作活动领域模型
从小学到大学都在学习数学，从小学开始了解数字的概念和背诵九九表到大学学习复变函数和离散数学，看起来好像掌握了这些数学知识，但是在工作中却很少真正用到这些知识，为什么？最近在研究一种开源软件-CARROT2的源代码的时候，又一次感觉到数学在计算机技术中的不可动摇的基础作用，CARROT2是一种用于自动语言分类（聚类）的工具性软件，用JAVA语言编写，它
Linux系统手动安装rzsz 软件包 daizj linux sz rz
1、下载软件 rzsz-3.34.tar.gz。登录linux，用命令 wget http://freeware.sgi.com/source/rzsz/rzsz-3.48.tar.gz下载。 2、解压 tar zxvf rzsz-3.34.tar.gz 3、安装 cd rzsz-3.34 ; make posix 。注意：这个软件安装与常规的GNU软件不
读源码之:ArrayBlockingQueue dieslrae java
ArrayBlockingQueue是concurrent包提供的一个线程安全的队列,由一个数组来保存队列元素.通过 takeIndex和 putIndex来分别记录出队列和入队列的下标,以保证在出队列时不进行元素移动. //在出队列或者入队列的时候对takeIndex或者putIndex进行累加,如果已经到了数组末尾就又从0开始,保证数
C语言学习九枚举的定义和应用 dcj3sjt126com c
枚举的定义 # include <stdio.h> enum WeekDay { MonDay, TuesDay, WednesDay, ThursDay, FriDay, SaturDay, SunDay }; int main(void) { //int day; //day定义成int类型不合适 enum WeekDay day = Wedne
Vagrant 三种网络配置详解 dcj3sjt126com vagrant
Forwarded port Private network Public network Vagrant 中一共有三种网络配置，下面我们将会详解三种网络配置各自优缺点。端口映射(Forwarded port)，顾名思义是指把宿主计算机的端口映射到虚拟机的某一个端口上，访问宿主计算机端口时，请求实际是被转发到虚拟机上指定端口的。Vagrantfile中设定语法为： c
16.性能优化-完结 frank1234 性能优化
性能调优是一个宏大的工程，需要从宏观架构(比如拆分，冗余，读写分离，集群，缓存等)，软件设计（比如多线程并行化，选择合适的数据结构），数据库设计层面（合理的表设计，汇总表，索引，分区，拆分，冗余等）以及微观（软件的配置，SQL语句的编写，操作系统配置等）根据软件的应用场景做综合的考虑和权衡，并经验实际测试验证才能达到最优。性能水很深，笔者经验尚浅，赶脚也就了解了点皮毛而已，我觉得
Word Search hcx2013 search
Given a 2D board and a word, find if the word exists in the grid. The word can be constructed from letters of sequentially adjacent cell, where "adjacent" cells are those horizontally or ve
Spring4新特性——Web开发的增强 jinnianshilongnian spring spring mvc spring4
Spring4新特性——泛型限定式依赖注入 Spring4新特性——核心容器的其他改进 Spring4新特性——Web开发的增强 Spring4新特性——集成Bean Validation 1.1(JSR-349)到SpringMVC Spring4新特性——Groovy Bean定义DSL Spring4新特性——更好的Java泛型操作API Spring4新
CentOS安装配置tengine并设置开机启动 liuxingguome centos
yum install gcc-c++ yum install pcre pcre-devel yum install zlib zlib-devel yum install openssl openssl-devel Ubuntu上可以这样安装 sudo aptitude install libdmalloc-dev libcurl4-opens
第14章工具函数（上） onestopweb 函数
index.html <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd"> <html xmlns="http://www.w3.org/
Xelsius 2008 and SAP BW at a glance blueoxygen BO Xelsius
Xelsius提供了丰富多样的数据连接方式，其中为SAP BW专属提供的是BICS。那么Xelsius的各种连接的优缺点比较以及Xelsius是如何直接连接到BEx Query的呢？以下Wiki文章应该提供了全面的概览。 http://wiki.sdn.sap.com/wiki/display/BOBJ/Xcelsius+2008+and+SAP+NetWeaver+BW+Co
oracle表空间相关 tongsh6 oracle
在oracle数据库中，一个用户对应一个表空间，当表空间不足时，可以采用增加表空间的数据文件容量，也可以增加数据文件，方法有如下几种： 1.给表空间增加数据文件 ALTER TABLESPACE "表空间的名字" ADD DATAFILE '表空间的数据文件路径' SIZE 50M; &nb
.Net framework4.0安装失败 yangjuanjava .net windows
上午的.net framework 4.0，各种失败，查了好多答案，各种不靠谱，最后终于找到答案了和Windows Update有关系，给目录名重命名一下再次安装，即安装成功了！下载地址：http://www.microsoft.com/en-us/download/details.aspx?id=17113 方法： 1.运行cmd，输入net stop WuAuServ 2.点击开

按字母分类： A B C D E F G H I J K L M N O P Q R S T U V W X Y Z 其他