一个雷达和摄像头融合的3D目标检测方法CenterFusion

点击上方“计算机视觉工坊”,选择“星标”

干货第一时间送达

作者丨黄浴@知乎

来源丨https://zhuanlan.zhihu.com/p/345845006

编辑丨计算机视觉工坊

以前提到过此文(在想法中),WACV‘2021录取:“CenterFusion: Center-based Radar and Camera Fusion for 3D Object Detection“,作者来自田纳西大学。

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第1张图片

摘要:这是一个middle fusion方法,CenterFusion,它先通过一个center point检测法得到图像的目标,然后和雷达检测结果做数据相关,采用的是一个frustum-based方法。最后关联的目标检测产生基于雷达的特征图补充图像特征,这样回归目标的深度、旋转角和深度。

作者提供了代码:https://github.com/mrnabati/CenterFusion

网络架构如图所示:跟摘要说的那样,细节见下面模块分析。

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第2张图片

首先,需要搞清楚雷达信号检测的是径向深度和目标实际速度的不同,如图:

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第3张图片

作者采用CenterNet方法,无锚单目的目标检测方法。其中keypoint的heatmap定义为:

采用一个卷积encoder-decoder网络预测Y。基于此,回归3D目标的深度、尺寸和朝向。其训练分类损失,即focal loss:

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第4张图片

CenterFusion利用CenterNet先得到一个初步检测,然后修正的DLA(deep layer aggregation)网络作为主干,在primary regression head中预测初步的3D目标信息,其中构成包括一个3X3的卷积层和一个1X1的卷积层。

Frustum association是关键融合雷达和图像的机制。用图像2D框和其深度+大小的估计构建一个3D RoI frustum,如图所示:

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第5张图片

如果有多个雷达检测点在这个RoI,直接取距离最近的一个。注意这里提到一个scaling factor可增大frustum尺寸,以便包容深度估计的误差。

另外,目标高度的不准确,作者采用Pillar expansion对雷达点云做预处理。如图所示:第一行是雷达点云扩大成3D pillar的显示,第二行是直接把pillars和图像匹配的结果,相关较弱。第三行是frustum相关,减少了上面的深度值重叠,也防止背景目标(如大楼)错分类成前景。

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第6张图片

图像和雷达的数据相关之后,可以提取雷达目标特征,深度和速度等。

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第7张图片

如果两个目标有重叠的heatmap区域,按距离取最近的。

之后,这些特征进入secondary regression head,其结构包括3个3X3卷积层和一个1X1卷积层。最后结果需要经过一个box decoder得到。

训练中regression head的损失采用SmoothL1 loss,center point heatmap采用focal loss,而attributes regression head基于Binary Cross Entropy (BCE) loss。

看一下结果:

性能比较表

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第8张图片 一个雷达和摄像头融合的3D目标检测方法CenterFusion_第9张图片

直观结果比较如下:1-2行CenterFusion,3-4行CenterNet。

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第10张图片

雷达点云绿色,目标框GT红色,目标预测速度蓝色箭头。

本文仅做学术分享,如有侵权,请联系删文。

下载1

在「计算机视觉工坊」公众号后台回复:深度学习,即可下载深度学习算法、3D深度学习、深度学习框架、目标检测、GAN等相关内容近30本pdf书籍。

下载2

在「计算机视觉工坊」公众号后台回复:计算机视觉,即可下载计算机视觉相关17本pdf书籍,包含计算机视觉算法、Python视觉实战、Opencv3.0学习等。

下载3

在「计算机视觉工坊」公众号后台回复:SLAM,即可下载独家SLAM相关视频课程,包含视觉SLAM、激光SLAM精品课程。

重磅!计算机视觉工坊-学习交流群已成立

扫码添加小助手微信,可申请加入3D视觉工坊-学术论文写作与投稿 微信交流群,旨在交流顶会、顶刊、SCI、EI等写作与投稿事宜。

同时也可申请加入我们的细分方向交流群,目前主要有ORB-SLAM系列源码学习、3D视觉CV&深度学习SLAM三维重建点云后处理自动驾驶、CV入门、三维测量、VR/AR、3D人脸识别、医疗影像、缺陷检测、行人重识别、目标跟踪、视觉产品落地、视觉竞赛、车牌识别、硬件选型、深度估计、学术交流、求职交流等微信群,请扫描下面微信号加群,备注:”研究方向+学校/公司+昵称“,例如:”3D视觉 + 上海交大 + 静静“。请按照格式备注,否则不予通过。添加成功后会根据研究方向邀请进去相关微信群。原创投稿也请联系。

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第11张图片

▲长按加微信群或投稿

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第12张图片

▲长按关注公众号

3D视觉从入门到精通知识星球:针对3D视觉领域的知识点汇总、入门进阶学习路线、最新paper分享、疑问解答四个方面进行深耕,更有各类大厂的算法工程人员进行技术指导。与此同时,星球将联合知名企业发布3D视觉相关算法开发岗位以及项目对接信息,打造成集技术与就业为一体的铁杆粉丝聚集区,近2000星球成员为创造更好的AI世界共同进步,知识星球入口:

学习3D视觉核心技术,扫描查看介绍,3天内无条件退款

一个雷达和摄像头融合的3D目标检测方法CenterFusion_第13张图片

 圈里有高质量教程资料、可答疑解惑、助你高效解决问题

觉得有用,麻烦给个赞和在看~  一个雷达和摄像头融合的3D目标检测方法CenterFusion_第14张图片

你可能感兴趣的:(算法,计算机视觉,人工智能,机器学习,深度学习)