KirutoCode

Point RCNN论文翻译及图解

文章目录

Abstract：
1.Introduction
2.Related Work
3.PointRCNN for Point Cloud 3D Detection

3.1 Bottom-up 3D proposal generation via point cloud segmentation
3.2 Point cloud region pooling
3.3 Canonical 3D bounding box refinement

图解

Abstract：

该论文的方法分成了两步：

stage-1：自底而上地生成3D proposals。从已经分为前景点和背景点的点云中直接生成一些高质量的3D proposals。（之前的方法都是从 RGB图或将点云映射到俯瞰图或映射成voxels等）
stage-2：阶段2的子网络将每个proposals的池化的点转换到正规坐标系，从而学习更好的局部空间特征，然后和阶段1学到的每个点的全局语义特征结合，来进行准确的box微调和置信度预测。

1.Introduction

现在的2D检测算法已经能处理图像中的大幅度的视角(viewpoints)和背景簇(backgroudn clutters)的变化，但是基于点云的3D目标检测仍然面对着来自不规则的数据形式和3D目标的六个自由度的巨大搜索空间的挑战。

现在的自动驾驶中，最常使用的3D传感器是LiDAR传感器，通过生成点云来捕捉场景的3D结构。基于点云的3D检测的困难主要在于点云的不规则性(irregularity)，3D检测的SOTA的方法，要么是将点云投射到俯视图来利用2D检测的框架，要么投射到前视图，要么是变成规则的3D voxels （如下图a）。但是这些都不是最佳的，而且还会遇到在量化(quantization)过程中信息缺失的问题。

Qi等人并没有将点云转换成voxels或其他的规则的数据结构来进行特征学习，而是提出PointNet，直接从点云数据来学习3D表示，用这个可以进行点云的分类和分割。

如下图b所示，他们后续的工作在3D目标检测中应用了PointNet，从2D RGB检测的结果获得了被截取的截椎点云(cropped frustum point cloud)，然后基于这个来估计3D bounding box。

但是这种方法过于依赖2D检测的表现，而且没有利用3D信息来生成鲁棒的bounding box proposals.

3D目标在自动驾驶的场景中能很好的分隔开，因为3D bounding box都是带注释的，这点和2D image检测不同。3D目标检测的训练数据直接提供3D目标分割的语义掩码，而2D目标检测的bounding box只能为语义分割提供弱监督。

基于这些观测，我们提出了新颖的两阶段3D目标检测框架，命名为PointRCNN，能够后直接操作3D点云，还能实现鲁棒且精准的3D检测表现。如下图c所示。

我们提出的框架包含两个阶段：

第一阶段：
目的：用一个自底而上的方法生成3D bounding box proposals
方法：通过利用3D bounding box来生成ground-truth分割掩码，第一阶段分割前景点，同时在这些被分割出来的点中生成少些bounding box proposals。
优势：避免了在整个3D空间使用大量的anchor box和保存大量的计算。
第二阶段：
目的：进行标准的3D box微调
方法：在3D proposals生成之后，用一个点云区域池化的操作来池化来自第一阶段的要被学习的点。和现存的3D方法不同，现存的3D方法都是直接估计全局box坐标，而作者的方法是将被池化的3D点转换到正则坐标，并且和来自阶段1的被池化的点的特征还有分割掩码结合，从而学习相对坐标微调。
优势：充分利用了第一阶段分割和推荐子网络提供的全部信息。

为了学习更有效的坐标微调，作者还提出了针对推荐生成和微调的完全基于bin的3D box回归损失,随后的消融实验(ablation experiments)表明，这个收敛更快而且相比其他3D box回归损失有更好的召回率

作者的贡献：

提出了一个基于点云的自底而上的生成3D边界框推荐的算法，该算法通过将点云分成前景物体和背景，来生成了少些高质量的3D proposals。被学习的点代表来自分割后，这样不仅有利于生成推荐的生成，而且对后面的box的生成也很有好处。
被提出的标准的3D边界框微调利用了第一阶段生成的高召回率的推荐框，而且用鲁棒的基于bin的loss来学习预测在正则坐标系中的box坐标微调
胜过了SOTA

2.Related Work

3D object detection from 2D images:
这是一些从image估计3D边界框的方法：

[24, 15] 利用3D和2D边界框之间的几何约束来恢复3D目标位置。
[1, 44, 23]利用3D目标和CAD模型的相似性。
Chen et al. [2, 3]用公式表示物体中的3D几何信息作为一个函数来给预定义的3D框评分。

但是这些工作只能产生粗糙的3D检测结果，原因是缺少深度信息，而且很容易被外观改变影响结果。

3D object detection from point clouds:
SOTA 3D目标检测方法提出了很多方法来从稀疏的3D点云中学习不同的特征。

[4, 14, 42, 17, 41]将点云投射到俯视图中，然后用2D CNN来学习点云的特征，之后再进行3D box生成。
Song et al. [34] and Zhou et al. [43]将点聚到一块形成voxels，然后用3D CNN去学习voxels的特征来生成3D boxes。

但是，无论是俯视图还是voxels，都会因为数据量化而造成信息丢失，而且3D CNN的内存和计算方面都不高效。

[25, 39]利用成熟的2D检测来从image生成2D proposals，并且在每个被裁剪的图像区域中减少了3D点的size。
PointNet [26, 28] 利用点云特征来进行3D框预测。

但是，基于2D图像的推荐生成很有可能在一些只能在3D空间下才能很好观测的情况下失败。而且，这些失败还不能通过3D框预测来恢复。
正相反的是，作者的自底而上的3D推荐生成方法，直接从点云生成鲁棒的3D推荐，既高效又不需要量化(quantization free)。

Learning point cloud representations：
Qi等人没有将点云变成voxels或者多视点格式，而是提出了PointNet框架来直接从原始点云学习点云特征，在点云的分割和分类处理上又快又准。之后进行的工作[28, 12]，通过考虑点云的局部结构来提高抽取特征的质量。
作者的工作将基于点的特征抽取拓展到了基于3D点云的目标检测中，因此形成了一个全新的二阶段3D检测框架（直接从原始点云生成3D框推荐和检测结果）。

3.PointRCNN for Point Cloud 3D Detection

3.1 Bottom-up 3D proposal generation via point cloud segmentation

现在的2D目标检测能分成两种：一种是一阶段的，通常更快但是直接估算目标边界框而没有微调；一种是二阶段的，在第二阶段微调proposals和confidence。然而，直接将2D的二阶段方法拓展到3D是不现实的，因为3D的搜索空间非常大，而且点云也是不规则的形式。

AVOD[14]在3D空间安置了80-100k个anchor boxes，而且再对视角中对每个anchor进行池化特征，以此来生成proposals。

FPointNet[25]从2D图像生成2D proposals，然后基于从2D区域裁剪出来的3D点来估计3D boxes，但是这样可能会忽略掉只有在3D空间才能观察到的物体。
作者提出了一种准确、鲁棒的基于全场景点云分割的3D proposals生成算法。作者观察到，在3D场景中，各个物体之间都是很自然的分隔开的，相互之间没有重叠。所有的3D物体的分割掩码都能通过他们的3D边界框注释直接获得，即，在3D框中的3D点可以被认为是前景点。

作者因此提出了在一个自底而上的方法中生成3D proposals。具体的，我们逐点地学习特征来分割原始点云，并且同时从已经分割好的前景点中生成3D proposals。基于这个自底而上的策略，我们的方法避免了使用一系列很多的在3D空间预定义的3D boxes，而且极大的限制了3D proposals生成的搜索空间。实验证明，我们的方法比基于3D anchor的推荐生成算法的召回率更高。

Learning point cloud representations
为了学习有区别的逐点特征来描述原始点云，我们使用带有多尺度分组的PointNet++作为主干网络，这还有一些其他的可选网络，也能作为我们的主干：such as [26, 13] or VoxelNet [43] with sparse convolutions [9]。

Foreground point segmentation
前景点在预测和他们相关联的物体的位置和方向的时候能提供充足的信息。为了学习如何分割前景点，点云网络被迫捕捉前后关系来做出精准的逐点预测，而且这对生成3D box也有好处。我们设计的自底而上的3D proposal生成方法直接从前景点生成3D box proposals，即，前景分割和3D box proposal生成同时进行。

考虑到主干点云网络编码的点向特征，我们增加了一个用于估计前景掩码的分割头，还增加了一个用于生成3D proposals的box回归头。3D ground-truth boxes提供ground-truth分割掩码来给点分割使用。对于一个大尺度的外景来说，前景点的数量是远小于背景点的。因此我们使用焦点损失(focal loss)[19]来处理类不平衡问题:

在训练点云分割的时候，设置 $\alpha_t = 0.25\ ,\gamma = 2$ 。

Bin-based 3D bounding box generation
正如上面提到的，添加了一个box回归头来和前景点分割同时生成自底而上的3Dproposasl。在训练的时候，只要求box回归头能从前景点中回归出3D bounding box位置。注意，虽然没有从背景点中回归box，但是因为点云网络的感受野，这些背景点也为生成box提供了支持信息。

一个3D边界框在LiDAR坐标系中被表示成 $(x,y,z,h,w,l,\theta)$ ,其中 $(x, y, z)$ 是目标中心位置， $(h, w, l)$ 是目标的size， $\theta$ 是俯视图下的目标方向。为了约束生成的3D box proposals，我们提出基于bin的回归损失来估算物体的3D bounding boxes。

为了估计一个目标的中心位置，如图3，我们将每个前景点周围的区域沿着 $Z, X$ 轴分裂成一系列的离散bin。具体来说，我们为当前前景点的每个 $X, Z$ 轴设置了一个搜索范围 $S$ ，每个一维搜索范围被划分成等长 $\delta$ 的bins来表示不同的物体在X-Z平面的中心 $(x, z)$ 。
我们发现，对X-Z轴使用基于bin的交叉熵损失分类，比直接用smooth $L 1$ loss回归，能得出更加精准鲁棒的中心定位结果。

对于 $X, Z$ 轴的定位loss由两部分组成：一部分是沿着每个X,Z轴的bin分类，一部分是在被分类好的bin中的残差回归。
对于沿着 $Y$ 轴的中心位置 $y$ ，我们直接使用smooth $L 1$ loss来回归，因为大部分物体的 $y$ 值都在一个很小的范围内，使用 $L 1$ loss足够获得精准的 $y$ 值。

定位公式

$x^{(p)},y^{(p)},z^{(p)})$ 是FPOI( foreground point of interest )的坐标。
$x^P,y^P,z^P)$ 是它对应的物体的中心坐标。
$bin^{(p)}_x,bin^{(p)}_z$ 是沿着 $X, Z$ 轴分配的ground-truth bin。
$res^{(p)}_x,res^{(p)}_z$ 是在被分配的bin中做进一步定位微调的ground-truth残差。
$C$ 是归一化的bin长度

Object属性设置：
对象的方向和size的估算方法和[25]差不多。我们将方向 $2\pi$ 分到 $n$ 个bins中，然后在 $x, z$ 方向计算bin分类目标 $bin^{p}_\theta$ 和残差回归对象 $res^{(p)}_\theta$ 。物体的size $(h, w, l)$ 通过计算关于整个训练集的每个类的平均目标尺寸来直接回归得到。

相关参数初始化\设置：
在推理阶段，对于基于bin的预测参数， $x,z,\theta$ ，我们首先选择有最高的预测置信度的bin中心，并且添加预测残差来获得微调的参数。对于其他的直接回归的参数，包括 $y, h, w, l$ ，我们将预测残差添加到到他们的初始值。

训练损失函数：
不同的训练损失项下的整个3D边界框的回归损失 $L_{reg}$ 能被如下表示：

$N_{pos}$ 是前景点的数量。
$\widehat{{bin}_u}^{(p)}$ 和 $\widehat{{res}_u}^{(p)}$ 是前景点 $p$ 的被预测的bin分配和残差。
${bin}^{(p)}_u$ 和 $res^{(p)}_u$ 是上面已经计算过的ground-truth对象。
$F_{cls}$ 是分类的交叉熵损失。
$F_{reg}$ 是smooth $L 1$ loss。

训练和推理的NMS：
为了移除冗余的proposals，我们对基于鸟瞰的定向IoU使用NMS，来生成少些高质量的proposals。
训练的时候，设置鸟瞰IoU的阈值是0.85，NMS保留前300个proposals来给阶段2的子网络训练。
推理的时候，设置鸟瞰IoU的阈值是0.8，NMS保留前100个proposals给阶段2的微调子网络使用。

3.2 Point cloud region pooling

要做的事情：
获取了3D边界框推荐之后，我们的目标是基于之前生成的box推荐来微调 box定位和方向。
为了学习每个proposals更具体的局部特征，我们建议根据每个3D推荐来池化来自阶段1的3D点以及它们对应的点特征。

扩大3D推荐框：
对于每个3D推荐框， $b_i = (x_i,y_i,z_i,h_i,w_i,l_i,\theta_i)$ ，我们稍微放大一下，创造一个新的3D框 $b^e_i=(x_i,y_i,z_i,h_i+\eta,w_i+\eta,l_i+\eta,\theta_i)$ 来从他的环境中编码额外的信息，其中 $\eta$ 是一个用来放大box的大小的固定值。

判断点在不在扩大的box内：
对于每个点 $p=(x^{(p)},y^{(p)},z^{(p)})$ ，执行一个内/外测试来判断这个点在不在被扩大的推荐框 $b^e_i$ 中。如果在的话，这个点和他的特征就会被保留用来微调 $b_i$ .
和内部的点 $p$ 相关的特征包括：

他的3D点坐标 $(x^{(p)},y^{(p)},z^{(p)})\in\R^3$
他的激光反射强度 $r^{(p)}\in\R$
他的来自阶段1的预测分割掩码 $m^{(p)}\in\{0,1\}$
他的来自一阶段的 $C$ 维学习点特征表示 $f^{(p)}\in\R^c$

我们通过包含分割掩码 $m^{(p)}$ 来区分在扩大的box里是前景点还是背景点。学习点特征 $f^{(p)}$ 通过学习编码有价值的信息，用于分割和生成proposals。在接下来的阶段中，我们将消除那些没有内部点的proposals。

3.3 Canonical 3D bounding box refinement

如图b所示，每个proposals的池化点和他们的相关特征都被喂进阶段二的子网络，来微调3D框位置还有前景目标置信度。

Canonical transformation:
为了利用我们第一阶段的高召回率的推荐框，并且仅估计推荐框参数的残差，我们将属于每个proposals的池化点转换为相应3D proposal的正则坐标系。

如上图所示，一个3D proposals的正则坐标系表示：

原点在推荐框的中间
局部的 $X^{'}$ 和 $Z^{'}$ 轴近似平行于地平面， $X^{'}$ 指向proposals的头部方向，另一个 $Z^{'}$ 轴垂直于 $X^{'}$
$Y^{'}$ 轴与LiDAR坐标系保持一致

推荐框的全部的池化点的坐标 $p$ 都应该通过合适的旋转和位移来转换成正则坐标系 $\widetilde{p}$ 。使用建议的正则坐标系统可以使box微调阶段更好地学习每个proposals的局部空间特征。

Feature learning for box proposal refinement：

微调子网络的组成：
微调子网络，由已经转换的局部空间点特征 $\widetilde{p}$ 和他们的来自阶段1的全局语义特征 $f^{(p)}$ 组成，进行更好的box和confidence微调。

正则变化的缺陷及解决方案：
尽管正则变换能够实现鲁棒的局部空间特征学习，但不可避免地会丢失每个对象的深度信息。例如，由于LiDAR传感器的固定角度扫描分辨率，远处的物体通常比附近的物体拥有更少的点。为了补偿深度信息的丢失，我们给传感器的加入距离，即， $d^{(p)}=\sqrt{(x^{(p)})^2+(y^{(p)})^2+(z^{(p)})^2}$ ，我们将这个东西加入到点 $p$ 的特征中。

proposals的所有特征都得到后，进行的操作：
对于每个proposals，首先将其关联点的局部空间特征 $\widetilde{p}$ 和额外特征 $r^{(p)},m^{(p)},d^{(p)}]$ 连接到几个全连接的层上，将它们的局部特征编码为与全局特征 $f^{(p)}$ 相同的维数。然后将局部特征和全局特征连接起来，按照[28]的结构喂进网络，得到有区别的特征向量，进行置信分类和box微调。

Losses for box proposal refinement：

gt与proposal对应：
我们对proposals微调采用类似的基于bin的回归损失。如果一个ground-trurh box和一个3D box proposals的IoU大于0.55，那么就把这个gt box分给3D box proposals来学习box微调。

3D proposals和相应的3D ground-truth boxes都被转换成正则坐标系，因此：

3D proposal $b_i=(x_i,y_i,z_i,h_i,w_i,l_i,\theta_i)$
to
$\widetilde{b}_i=(0,0,0,h_i,w_i,l_i,0)$

3D ground-truth box $b^{gt}_i=(x^{gt}_i,y^{gt}_i,z^{gt}_i,h^{gt}_i,w^{gt}_i,l^{gt}_i,\theta^{gt}_i)$
to
$\widetilde{b}^{gt}_i=(x^{gt}_i-x_i,y^{gt}_i-y_i,z^{gt}_i-z_i,h^{gt}_i,w^{gt}_i,l^{gt}_i,\theta^{gt}_i-\theta_i)$

训练时box位置和size：
训练的对象的第 $i$ 个bo推荐框的中心位置， $(bin^i_{\Delta x},bin^i_{\Delta z},res^i_{\Delta x},res^i_{\Delta z},res^i_{\Delta y})$ ,设置方法和公式2相同，只是我们使用更小的搜索范围 $S$ 来微调3D proposal的位置。
关于训练集中的每个类的平均物体尺寸，我们仍然直接回归尺寸残差 $(res^i_{\Delta h},res^i_{\Delta w},res^i_{\Delta l})$ ，这样做是因为被池化的稀疏点通常不能提供足够的proposal尺寸信息 $h_i,w_i,l_i)$ 。

训练时微调方向：
对于微调方向，关于ground-turth方向我们假定角度是不同的， $\theta^{gt}_i-\theta_i$ 的范围是 $[-{\pi \over 4},{\pi \over 4}]$ ，这是因为IoU大于0.55的。因此，我们把 $\pi \over 2$ 分成离散的bin和bin的尺寸 $w$ ，并且预测基于bin的方向目标：

所以，整个二阶段子网络的全部loss如下：

$\beta$ 是来自一阶段的3D proposals几何
$B_{pos}$ 存放着positive的回归proposals
$prob_i$ 是估算的 $\widetilde{b}_i$ 的置信度
$label_i$ 是对应的label
$\widetilde{L}^{(i)}_{bin}$ 和 $\widetilde{L}^{(i)}_{res}$ 和公式3中的相似，但是使用的是上面提到的通过 $\widetilde{b}^{gt}_i$ 和 $\widetilde{b}_i$ 计算的新的对象

最后应用鸟瞰IoU阈值0.01的有方向的NMS去除重叠的边界框，并且生成被检测对象的三维边界框。

图解

参考博客地址
第一次看3D检测论文，实在是没看懂，只是整理下论文和参考的博客的内容，希望有大佬能指正教我

RPN网络

RCNN网络

论文-A Stack-Propagation Framework with Token-Level Intent Detection for Spoken Language Understanding 魏鹏飞
1.简称论文《AStack-PropagationFrameworkwithToken-LevelIntentDetectionforSpokenLanguageUnderstanding》，作者LiboQin(HarbinInstituteofTechnology,China)，经典的NLU论文（SemanticFrame）。2.摘要意图检测和槽位填充是构建口语理解（SLU）系统的两个主要任务。
网络安全要点总结大嘴巴子计算机网络 web安全安全
1.入侵检测与防御：1）入侵检测与系统IDS(intrusiondetectionsystem):防火墙之后的第二道闸门；IDS的部署：采用镜像端口或者集线器方式；部署在：服务器交换机上，internet接入路由器后面的第一台交换机上；IRSintrusionresponsesystem入侵响应系统：2）.IPS（intrusionpreventionsystem）:入侵防御系统；检测并中断；检测
论文阅读笔记（十九）：YOLO9000: Better, Faster, Stronger __Sunshine__ 笔记 YOLO9000 detection classification
WeintroduceYOLO9000,astate-of-the-art,real-timeobjectdetectionsystemthatcandetectover9000objectcategories.FirstweproposevariousimprovementstotheYOLOdetectionmethod,bothnovelanddrawnfrompriorwork.Theim
在COD领域，图像中提取的高频和低频信息分别代表什么？ Wils0nEdwards 计算机视觉人工智能
在CamouflagedObjectDetection(COD)领域中，图像中的高频和低频信息在特征提取和物体检测中有着不同的含义和作用。COD的本质是解决目标在视觉上与背景高度相似的问题，因此合理利用图像的频率信息（高频和低频）有助于提高检测效果。高频信息高频信息指的是图像中变化迅速的部分，通常包括细节、边缘和纹理等特征。在COD中：高频信息代表图像中的边缘、细节和纹理特征。这些特征对于分割伪装
深度学习目标检测入门COCO数据集日暮途远z 深度学习目标检测人工智能
常见数据集类型：COCO数据集：Pytorch加载COCO数据集：COCO数据集的读取COCO_dataset=torchvision.datasets.CocoDetection(root="./dataset/val2017",annFile="./instances_val2017/instances_val2017.json")root(strorpathlib.Path)–Rootdir
Transformer+目标检测，这一篇入门就够了 BIT可达鸭 ▶深度学习-计算机视觉 transformer 深度学习目标检测计算机视觉自然语言处理
VisionTransformerforObjectDetection本文作者：Encoder-Decoder简介：Encoder-Decoder的缺陷：Attention机制：Self-Attention机制：Multi-HeadAttention：Transformer结构：图像分类之ViT：图像分类之PyramidViT：目标检测之DETR：目标检测之DeformableDETR：本文作者：
DEFT 开源项目教程马安柯Lorelei
DEFT开源项目教程DEFTJointdetectionandtrackingmodelnamedDEFT,or``DetectionEmbeddingsforTracking."Ourapproachreliesonanappearance-basedobjectmatchingnetworkjointly-learnedwithanunderlyingobjectdetectionnetwor
YOLO缺陷检测学习笔记（2） tt555555555555 YOLO 缺陷检测学习笔记 YOLO 学习笔记
YOLO缺陷检测学习笔记（2）残差连接1.**YOLO的残差连接结构**2.**YOLO使用残差连接的目的**3.**YOLO中的残差块**4.**YOLOv3和YOLOv4的残差连接架构**YOLO网络架构概述1.特征提取网络2.预测头（DetectionHead）3.后处理（Post-processing）YOLOv3/v4的改进YOLOv3YOLOv4SoftmaxSoftmax的性质：So
如何有效解决Git推送冲突：实用指南 Crazy learner 其他 git
目录背景常见错误与解决步骤总结在使用Git进行版本控制时，经常会遇到推送冲突的问题。这种冲突通常发生在团队合作中，当多个成员同时对同一仓库进行更改时尤其常见。在本文中，我将通过一个实际的例子详细解释如何解决推送冲突，确保代码的安全合并。背景在本例中，我们有一个GitLab仓库，名为factory_sound_detection_tool，围绕此仓库，我们会看到如何解决分支合并和推送冲突。常见错误与
旋转目标检测：mmrotate仓库中 “主要模型” 及其 “配置文件” 的列表沉浸式AI AI与SLAM论文解析旋转目标检测深度学习 mmrotate
mmrotate目录:mmrotate仓库中的主要模型和配置BackgroundandMotivation背景与动机MethodsOverview方法概述1.CFACFA:Convex-hullFeatureAdaptationforOrientedandDenselyPackedObjectDetectionCFA：用于定向和密集对象检测的凸包特征适应2.ConvNeXtConvNeXt:ACo
深度学习论文精读（7）：MTCNN hwl19951007 计算机视觉论文精读
深度学习论文精读（7）：MTCNN论文地址：JointFaceDetectionandAlignmentusingMulti-taskCascadedConvolutionalNetworks译文地址：https://zhuanlan.zhihu.com/p/37884254参考博文1：https://zhuanlan.zhihu.com/p/38520597官方地址：https://kpzhan
人脸识别算法MTCNN论文解读纸上得来终觉浅～图像处理 paper阅读人脸识别 mtcnn
论文名称：JointFaceDetectionandAlignmentusingMulti-taskCascadedConvolutionalNetworks论文地址：https://www.lao-wang.com/wp-content/uploads/2017/07/1604.02878.pdf1、MTCNN原理MTCNN，Multi-taskconvolutionalneuralnetwor
入侵检测系统与防火墙_入侵检测系统：它与防火墙有何不同？ cumt30111 网络安全 java linux 区块链
入侵检测系统与防火墙Aswehavealreadydiscussedthat"IntrusionDetectionSystems(IDS's)"aredefinedtobeassuchspeciallydesignedsecuritysoftwareusedforthepurposeofdetectingandinformingtheusersandadministratorsabouttheva
为量产而设计：自动驾驶车辆激光雷达旋转外参在线标定与异常排除策略智驾机器人技术前线高精定位与大规模建图自动驾驶算法机器人
更多精彩内容，请关注公众号：智驾机器人技术前线1.论文信息论文标题：FaultDetectionandExclusionforRobustOnlineCalibrationofVehicletoLiDARRotationParameter作者：JiwonSeok,ChansooKim,PauloResende,BenazouzBradai,andKichunJo作者单位：韩国首尔大学论文链接：ht
图像处理 -- 图像清晰度测量方法 sz66cm 图像处理计算机视觉
图像清晰度测量方法拉普拉斯算子（LaplacianOperator）拉普拉斯算子是一种二阶导数算子，用于检测图像的边缘。清晰的图像通常具有更多且更明显的边缘。边缘检测（EdgeDetection）常用的边缘检测算法包括Sobel、Prewitt和Canny边缘检测器。通过计算边缘的数量和强度，可以间接判断图像的清晰度。方差（Variance）方差用于衡量图像灰度值的分布情况。图像中灰度值的方差越大
Official pytorch implementation of “Mamba-YOLO：SSMs-based for Object Detection” weixin_42918943 pytorch YOLO 目标检测
#pipinstallrequiredpackagescondacreate-nmambayolo-ypython=3.11condaactivatemambayolopip3installtorch===2.3.0torchvisiontorchaudiopipinstallseabornthoptimmeinopscdselective_scan&&pipinstall.&&cd..pipin
智能合约漏洞检测论文 weixin_45332030 智能合约
综述TestingEthereumSmartContracts:AComparisonofSymbolicAnalysisandFuzzTestingTools符号执行与模糊测试工具的比较综述DeepLearningBasedVulnerabilityDetection:AreWeThereYet?基于深度学习的漏洞检测研究https://github.com/VulDetProject/ReVe
线段检测：Towards Light-weight and Real-time Line Segment Detection Towards Light-weight and Real【方法解读】智维探境 AI与SLAM论文解析人工智能线段检测论文阅读检测
目录摘要1引言2相关工作深度线段检测实时目标检测3用于线段检测的M-LSD3.1网络架构(a)TP表示法(b)SoL增广总结3.2线段表示详细解析1.线段表示的重要性2.TP表示法3.位移向量4.坐标表示5.训练过程6.非极大值抑制7.简单算术操作总结图5：匹配损失和几何损失图5标题内容解析3.3匹配损失3.3匹配损失解析1.背景和动机2.中心损失和位移损失3.匹配损失的引入4.匹配损失的计算步骤
论文阅读瞎记(四) Cascade R-CNN: Delving into High Quality Object Detection 2017 码大哥深度学习人工智能
概述在物体检测中1，IOU阈值被用于判定正负样本。在低IOU阈值比如0.5的状态下训练模型经常产生噪音预测，然而检测效果会随着IOU增加而降低。两个主要因素：1.训练时的过拟合，正样本指数消失2.检测器最优IOU与输入假设的不匹配。一个单阶段的物体检测器CascadeR-CNN被提出用于解决这些问题。网络由一个检测序列组成，这些序列训练时会伴随IOU增长从而对FP样本更加有选择性地判别。检测器一个
目标检测：Cascade R-CNN: Delving into High Quality Object Detection - 2017【方法解读】智维探境 AI与SLAM论文解析目标检测 cnn Cascade R-CNN
查看新版本论文：目标检测：CascadeR-CNN:HighQualityObjectDetectionandInstanceSegmentation-2019【方法解读】目录摘要：1.引言2.相关工作3.对象检测3.1.边界框回归3.2.分类3.3.检测质量4.级联R-CNN4.1.级联边界框回归4.2.级联检测摘要：在目标检测中，需要一个交并比（IoU）阈值来定义正样本和负样本。使用低IoU阈
PaddleDetection多目标跟踪报错MCMOTEvaluator is not exist, so the MOTA will be -INF ATM006 目标检测
ppdet.metrics.mcmot_metricsWARNING:gt_filename'{}'ofMCMOTEvaluatorisnotexist,sotheMOTAwillbe-INFPaddleDetection/ppdet/metrics/mcmot_metrics.pyclassMCMOTEvaluator(object):def__init__(self,data_root,seq
MS COCO数据集目标检测评估（Detection Evaluation） Ambition_LAO 人工智能计算机视觉
MSCOCO(MicrosoftCommonObjectsinContext)是一个广泛应用于计算机视觉领域的数据集和评估平台，尤其是在目标检测、分割和人体关键点检测等任务中。COCO数据集和其评估方法被广泛用于学术研究和工业应用。以下是对MSCOCO数据集目标检测评估、人体关键点评估、输出数据的结果格式以及如何参加比赛的详细阐述和总结。1.MSCOCO数据集目标检测评估（DetectionEva
新手常见错误：Compressor detection can only be called on some xcontent bytes or compressed xcontent bytes Blue的成长日记运维 java spring boot
目录报错信息分析：1.检查数据源：2.使用正确的编码：3.检查压缩状态：4.使用正确的API方法：5.查看示例代码：6.调试和日志：7.更新Elasticsearch客户端库：结语：报错信息org.elasticsearch.common.compress.NotXContentException:Compressordetectioncanonlybecalledonsomexcontentby
进程服务监测与自愈 liao__ran python 运维 python 运维
#!/usr/bin/python3#encoding:utf-8#filename:service-detection-repair.py#author:gaohaixiang#writetime:202403041043"""#定时任务监测示例*/5****python3/data/processlog/service-detection-repair.pysystemctlCheckngin
LaneNet 车道线检测项目教程邬稳研Beneficient
LaneNet车道线检测项目教程lanenet-lane-detection-pytorch项目地址:https://gitcode.com/gh_mirrors/la/lanenet-lane-detection-pytorch项目介绍LaneNet是一个基于PyTorch的实时车道线检测模型，主要基于IEEEIV会议论文"TowardsEnd-to-EndLaneDetection:anIns
AI推介-大语言模型LLMs论文速览（arXiv方向）：2024.03.20-2024.03.25 小小帅AIGC LLMs论文时报人工智能语言模型自然语言处理 LLM 大语言模型论文推送深度学习
文章目录~1.IterativeRefinementofProject-LevelCodeContextforPreciseCodeGenerationwithCompilerFeedback2.TrustAIatSemEval-2024Task8:AComprehensiveAnalysisofMulti-domainMachineGeneratedTextDetectionTechniques
开始使用入侵检测系统(IDS)Bro:安装（2/4） Threathunter
来源：https://dallinwarne.com/networking/getting-started-with-intrusion-detection-system-ids-bro-part-2/这是关于如何开始使用BroIDS的四部分系列文章的第二部分。请参阅第1部分关于安装Bro先决条件的内容。这篇文章是关于安装和准备Bro。一、Bro编译与安装既然满足了先决条件，现在就可以编译和安装B
高质量 Git 仓库汇总（持续更新，方便查看） Nice_cool. 学习
Leetcodehttps://github.com/kamyu104/LeetCode-SolutionsCmakehttps://github.com/viva64/pvs-studio-cmake-examples3D目标检测Awesome-3D-Object-DetectionAwesome-3D-Object-Detection-for-Autonomous-DrivingCudaCod
MMDetection3D v1.4.0安装教程 Ly.Leo 激光雷达神经网络点云 3d 激光雷达目标检测
安装MMDetection3Dv1.4.01.系统环境2.安装2.1基本环境安装2.2调整具体版本2.3验证2.3安装MinkowskiEngine和TorchSparse3.最终环境配置5.附加库根据v1.4.0版本官方手册测试后的安装配置，亲测可行。1.系统环境项目版本日期Ubuntu18.04.06LTS-显卡RTX2070-显卡驱动525.105.17-2.安装MMDetection3D的
C# Onnx GroundingDINO 开放世界目标检测乱蜂朝王人工智能 c#目标检测开发语言
目录介绍效果模型信息项目代码下载介绍地址：https://github.com/IDEA-Research/GroundingDINOOfficialimplementationofthepaper"GroundingDINO:MarryingDINOwithGroundedPre-TrainingforOpen-SetObjectDetection"效果在运行程序时，要注意输入的提示词的格式，类
js动画html标签（持续更新中） 843977358 html js 动画 media opacity
1.jQuery 效果 - animate() 方法改变 "div" 元素的高度： $(".btn1").click(function(){ $("#box").animate({height:"300px
springMVC学习笔记 caoyong springMVC
1、搭建开发环境 a>、添加jar文件，在ioc所需jar包的基础上添加spring-web.jar,spring-webmvc.jar b>、在web.xml中配置前端控制器 <servlet> &nbs
POI中设置Excel单元格格式 107x poi style 列宽合并单元格自动换行
引用：http://apps.hi.baidu.com/share/detail/17249059 POI中可能会用到一些需要设置EXCEL单元格格式的操作小结：先获取工作薄对象: HSSFWorkbook wb = new HSSFWorkbook(); HSSFSheet sheet = wb.createSheet(); HSSFCellStyle setBorder = wb.
jquery 获取A href 触发js方法的this参数无效的情况一炮送你回车库 jquery
html如下： <td class=\"bord-r-n bord-l-n c-333\"> <a class=\"table-icon edit\" onclick=\"editTrValues(this);\">修改</a> </td>" j
md5 3213213333332132 MD5
import java.security.MessageDigest; import java.security.NoSuchAlgorithmException; public class MDFive { public static void main(String[] args) { String md5Str = "cq
完全卸载干净Oracle11g sophia天雪 orale数据库卸载干净清理注册表
完全卸载干净Oracle11g A、存在OUI卸载工具的情况下：第一步：停用所有Oracle相关的已启动的服务；第二步：找到OUI卸载工具：在“开始”菜单中找到“oracle_OraDb11g_home”文件夹中 &
apache 的access.log 日志文件太大如何解决 darkranger apache
CustomLog logs/access.log common 此写法导致日志数据一致自增变大。直接注释上面的语法 #CustomLog logs/access.log common 增加： CustomLog "|bin/rotatelogs.exe -l logs/access-%Y-%m-d.log
Hadoop单机模式环境搭建关键步骤 aijuans 分布式
Hadoop环境需要sshd服务一直开启，故，在服务器上需要按照ssh服务，以Ubuntu Linux为例，按照ssh服务如下： sudo apt-get install ssh sudo apt-get install rsync 编辑HADOOP_HOME/conf/hadoop-env.sh文件，将JAVA_HOME设置为Java
PL/SQL DEVELOPER 使用的一些技巧 atongyeye java sql
1 记住密码这是个有争议的功能，因为记住密码会给带来数据安全的问题。但假如是开发用的库，密码甚至可以和用户名相同，每次输入密码实在没什么意义，可以考虑让PLSQL Developer记住密码。位置：Tools菜单－－Preferences－－Oracle－－Logon HIstory－－Store with password 2 特殊Copy 在SQL Window
PHP：在对象上动态添加一个新的方法 bardo 方法动态添加闭包
有关在一个对象上动态添加方法，如果你来自Ruby语言或您熟悉这门语言，你已经知道它是什么...... Ruby提供给你一种方式来获得一个instancied对象，并给这个对象添加一个额外的方法。好！不说Ruby了，让我们来谈谈PHP PHP未提供一个“标准的方式”做这样的事情，这也是没有核心的一部分... 但无论如何，它并没有说我们不能做这样
ThreadLocal与线程安全 bijian1013 java java多线程 threadLocal
首先来看一下线程安全问题产生的两个前提条件： 1.数据共享，多个线程访问同样的数据。 2.共享数据是可变的，多个线程对访问的共享数据作出了修改。实例：定义一个共享数据： public static int a = 0;
Tomcat 架包冲突解决征客丶 tomcat Web
环境： Tomcat 7.0.6 win7 x64 错误表象：【我的冲突的架包是：catalina.jar 与 tomcat-catalina-7.0.61.jar 冲突，不知道其他架包冲突时是不是也报这个错误】严重: End event threw exception java.lang.NoSuchMethodException: org.apache.catalina.dep
【Scala三】分析Spark源代码总结的Scala语法一 bit1129 scala
Scala语法 1. classOf运算符 Scala中的classOf[T]是一个class对象，等价于Java的T.class,比如classOf[TextInputFormat]等价于TextInputFormat.class 2. 方法默认值 defaultMinPartitions就是一个默认值，类似C++的方法默认值
java 线程池管理机制 BlueSkator java线程池管理机制
编辑 Add Tools jdk线程池一、引言第一：降低资源消耗。通过重复利用已创建的线程降低线程创建和销毁造成的消耗。第二：提高响应速度。当任务到达时，任务可以不需要等到线程创建就能立即执行。第三：提高线程的可管理性。线程是稀缺资源，如果无限制的创建，不仅会消耗系统资源，还会降低系统的稳定性，使用线程池可以进行统一的分配，调优和监控。
关于hql中使用本地sql函数的问题（问-答） BreakingBad HQL 存储函数
转自于：http://www.iteye.com/problems/23775 问：我在开发过程中，使用hql进行查询（mysql5）使用到了mysql自带的函数find_in_set()这个函数作为匹配字符串的来讲效率非常好，但是我直接把它写在hql语句里面（from ForumMemberInfo fm,ForumArea fa where find_in_set(fm.userId,f
读《研磨设计模式》-代码笔记-迭代器模式-Iterator bylijinnan java 设计模式
声明：本文只为方便我个人查阅和理解，详细的分析以及源代码请移步原作者的博客http://chjavach.iteye.com/ import java.util.Arrays; import java.util.List; /** * Iterator模式提供一种方法顺序访问一个聚合对象中各个元素，而又不暴露该对象内部表示 * * 个人觉得，为了不暴露该
常用SQL chenjunt3 oracle sql C++c C#
--NC建库 CREATE TABLESPACE NNC_DATA01 DATAFILE 'E:\oracle\product\10.2.0\oradata\orcl\nnc_data01.dbf' SIZE 500M AUTOEXTEND ON NEXT 50M EXTENT MANAGEMENT LOCAL UNIFORM SIZE 256K ; CREATE TABLESPA
数学是科学技术的语言 comsci 工作活动领域模型
从小学到大学都在学习数学，从小学开始了解数字的概念和背诵九九表到大学学习复变函数和离散数学，看起来好像掌握了这些数学知识，但是在工作中却很少真正用到这些知识，为什么？最近在研究一种开源软件-CARROT2的源代码的时候，又一次感觉到数学在计算机技术中的不可动摇的基础作用，CARROT2是一种用于自动语言分类（聚类）的工具性软件，用JAVA语言编写，它
Linux系统手动安装rzsz 软件包 daizj linux sz rz
1、下载软件 rzsz-3.34.tar.gz。登录linux，用命令 wget http://freeware.sgi.com/source/rzsz/rzsz-3.48.tar.gz下载。 2、解压 tar zxvf rzsz-3.34.tar.gz 3、安装 cd rzsz-3.34 ; make posix 。注意：这个软件安装与常规的GNU软件不
读源码之:ArrayBlockingQueue dieslrae java
ArrayBlockingQueue是concurrent包提供的一个线程安全的队列,由一个数组来保存队列元素.通过 takeIndex和 putIndex来分别记录出队列和入队列的下标,以保证在出队列时不进行元素移动. //在出队列或者入队列的时候对takeIndex或者putIndex进行累加,如果已经到了数组末尾就又从0开始,保证数
C语言学习九枚举的定义和应用 dcj3sjt126com c
枚举的定义 # include <stdio.h> enum WeekDay { MonDay, TuesDay, WednesDay, ThursDay, FriDay, SaturDay, SunDay }; int main(void) { //int day; //day定义成int类型不合适 enum WeekDay day = Wedne
Vagrant 三种网络配置详解 dcj3sjt126com vagrant
Forwarded port Private network Public network Vagrant 中一共有三种网络配置，下面我们将会详解三种网络配置各自优缺点。端口映射(Forwarded port)，顾名思义是指把宿主计算机的端口映射到虚拟机的某一个端口上，访问宿主计算机端口时，请求实际是被转发到虚拟机上指定端口的。Vagrantfile中设定语法为： c
16.性能优化-完结 frank1234 性能优化
性能调优是一个宏大的工程，需要从宏观架构(比如拆分，冗余，读写分离，集群，缓存等)，软件设计（比如多线程并行化，选择合适的数据结构），数据库设计层面（合理的表设计，汇总表，索引，分区，拆分，冗余等）以及微观（软件的配置，SQL语句的编写，操作系统配置等）根据软件的应用场景做综合的考虑和权衡，并经验实际测试验证才能达到最优。性能水很深，笔者经验尚浅，赶脚也就了解了点皮毛而已，我觉得
Word Search hcx2013 search
Given a 2D board and a word, find if the word exists in the grid. The word can be constructed from letters of sequentially adjacent cell, where "adjacent" cells are those horizontally or ve
Spring4新特性——Web开发的增强 jinnianshilongnian spring spring mvc spring4
Spring4新特性——泛型限定式依赖注入 Spring4新特性——核心容器的其他改进 Spring4新特性——Web开发的增强 Spring4新特性——集成Bean Validation 1.1(JSR-349)到SpringMVC Spring4新特性——Groovy Bean定义DSL Spring4新特性——更好的Java泛型操作API Spring4新
CentOS安装配置tengine并设置开机启动 liuxingguome centos
yum install gcc-c++ yum install pcre pcre-devel yum install zlib zlib-devel yum install openssl openssl-devel Ubuntu上可以这样安装 sudo aptitude install libdmalloc-dev libcurl4-opens
第14章工具函数（上） onestopweb 函数
index.html <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd"> <html xmlns="http://www.w3.org/
Xelsius 2008 and SAP BW at a glance blueoxygen BO Xelsius
Xelsius提供了丰富多样的数据连接方式，其中为SAP BW专属提供的是BICS。那么Xelsius的各种连接的优缺点比较以及Xelsius是如何直接连接到BEx Query的呢？以下Wiki文章应该提供了全面的概览。 http://wiki.sdn.sap.com/wiki/display/BOBJ/Xcelsius+2008+and+SAP+NetWeaver+BW+Co
oracle表空间相关 tongsh6 oracle
在oracle数据库中，一个用户对应一个表空间，当表空间不足时，可以采用增加表空间的数据文件容量，也可以增加数据文件，方法有如下几种： 1.给表空间增加数据文件 ALTER TABLESPACE "表空间的名字" ADD DATAFILE '表空间的数据文件路径' SIZE 50M; &nb
.Net framework4.0安装失败 yangjuanjava .net windows
上午的.net framework 4.0，各种失败，查了好多答案，各种不靠谱，最后终于找到答案了和Windows Update有关系，给目录名重命名一下再次安装，即安装成功了！下载地址：http://www.microsoft.com/en-us/download/details.aspx?id=17113 方法： 1.运行cmd，输入net stop WuAuServ 2.点击开