阿里达摩院新研究：实习生一作，首次实现3D物体检测精度与速度兼得

极市平台 2021-09-20

加入极市专业CV交流群，与6000+来自腾讯，华为，百度，北大，清华，中科院等名企名校视觉开发者互动交流！更有机会与李开复老师等大牛群内互动！
同时提供每月大咖直播分享、真实项目需求对接、干货资讯汇总，行业技术交流。关注 极市平台 公众号，回复 加群，立刻申请入群~

来源：量子位@微信公众号

最新消息，阿里达摩院又有新的研究进展，这次在自动驾驶3D物体检测领域。

达摩院的研究人员提出一个通用、高性能的检测器，在自动驾驶领域权威数据集KITTI BEV(鸟瞰)上，检测速度达到25FPS ，一举占据榜首，与排名第二的方案相比，减少了一半多，同时精度也远超其他的单阶段检测器。可以说首次实现3D物体检测精度与速度兼得。

达摩院研究团队表示：“检测器是自动驾驶系统的核心组件之一，但该领域一直缺少创新和突破，此次我们实现3D检测精度和速度的提升，将有助于提高自动驾驶系统的安全性。”

从实验结果来看，他们显然取得了良好进展，而且研究的主要完成人员（一作），还是达摩院的实习生。

同时，该研究也得到了同行们的认可，被计算机视觉领域顶级会议CVPR 2020收录。他们是如何做到的呢？我们借助阿里达摩院提供的解读，一一来看。

如何实现精度和速度兼得？

众所周知，与普通2D图像识别应用不同，自动驾驶系统对精度和速度的要求更高，不仅需要快速识别周围环境的物体，还要对物体在三维空间中的位置做精准定位。

仅靠传感器和算法模型，通常无法平衡视觉识别的精度和速度。因此，检测器成为提升自动驾驶系统安全性的一个关键因素。

经过多年研究，当前业界主流的单阶段检测器在检测速度上很好，但在检测精度却差强人意。

这就是达摩院研究的出发点：寻找一种能二者兼得的方法。

他们提出的思路是：将两阶段检测器中对特征进行细粒度刻画的思想，移植到单阶段检测中。

在他们的模型中，用于部署的检测器，即推断网络，由一个骨干网络和检测头组成。

骨干网络用3D的稀疏网络实现，用于提取含有高语义的体素特征。检测头将体素特征压缩成鸟瞰图表示，并在上面运行2D全卷积网络来预测3D物体框。

他们在训练中利用一个辅助网络将单阶段检测器中的体素特征，转化为点级特征并施加一定的监督信号。

在实现上，他们将卷积特征中的非零信号映射到原始的点云空间中，然后在每个点上进行插值，来获取卷积特征的点级表示。使得卷积特征也具有结构感知能力，来提高检测精度。

而在做模型推断时，辅助网络并不参与计算（detached），保证单阶段检测器的检测效率。

另外，他们还提出一个工程上的改进：Part-sensitive Warping (PSWarp)，用于处理单阶段检测器中存在的 “框-置信度-不匹配” 问题。

核心思路是：利用采样器，用生成的采样网格在对应的局部敏感特征图上进行采样，生成对齐好的特征图。最终能反映置信度的特征图，是K个对齐好特征图的平均。

单阶段方法，能达到两阶段方法精度

阿里达摩院的研究人员，在KITTI数据集上评估了方法的有效性。下图（PR Curve）中，实线为两阶段方法，虚线为单阶段方法。

可以看出，达摩院提出的单阶段方法（黑色）能够达到两阶段方法才能达到的精度。

下图展示了他们在KITTI 鸟瞰(BEV) 和 3D 测试集上的结果。

可以看出，他们提出的方法，可以在不增加额外计算量的情况下，达到25FPS 的检测速度，而且还能保持精度。具体的检测效果如下：

两位共同一作，都是达摩院研究实习生

研究论文，标题为“Structure Aware Single-Stage 3D Object Detection from Point Cloud”，共有5名研究人员参与，分别来自阿里达摩院和香港理工大学。

第一作者是Chenhang He，是阿里达摩院的研究实习生，正在香港理工大学读博，预计2022年毕业。

他的导师是达摩院高级研究员、香港理工大学电子计算学系讲座教授、IEEE Fellow张磊，也是这一研究的通讯作者。

另一位第一作者Hui Zeng，也是是阿里达摩院的研究实习生，同样是张磊的博士生，预计在今年毕业。

其他作者，分别是达摩院高级研究员、IEEE Fellow华先胜、达摩院资深算法专家黄建强等。

-END-

推荐阅读：

极市平台视觉算法季度赛，提供真实应用场景数据和免费算力，特殊时期，一起在家打比赛吧！

添加极市小助手微信（ID : cv-mart），备注：研究方向-姓名-学校/公司-城市（如：目标检测-小极-北大-深圳），即可申请加入目标检测、目标跟踪、人脸、工业检测、医学影像、三维&SLAM、图像分割等极市技术交流群，更有每月大咖直播分享、真实项目需求对接、求职内推、算法竞赛、干货资讯汇总、行业技术交流，一起来让思想之光照的更远吧~

△长按添加极市小助手

△长按关注极市平台，获取最新CV干货

觉得有用麻烦给个在看啦~

: ， . Video Mini Program Like ，轻点两下取消赞 Wow ，轻点两下取消在看

”FAN某”的离婚财产分割判决书（全文）

”FAN某”的离婚财产分割判决书（全文）

公益慈善｜“翼行天下一生守护”慈善项目捐赠仪式圆满举行！

哈里斯女粉搞4B运动、毒杀丈夫，回旋镖能否让美国“血流成河”

比国产光刻机更重要的IPO要来了！

阿里达摩院新研究：实习生一作，首次实现3D物体检测精度与速度兼得

如何实现精度和速度兼得？

单阶段方法，能达到两阶段方法精度

两位共同一作，都是达摩院研究实习生

极市直播| (CVPR2020 Oral) 陈昊：超越Mask RCNN的BlendMask，实例分割新标杆

谷歌AI良心开源：一部手机就能完成3D目标检测，还是实时的那种

超全的3D视觉数据集汇总

您可能也对以下帖子感兴趣

”FAN某”的离婚财产分割判决书（全文）

”FAN某”的离婚财产分割判决书（全文）

公益慈善｜“翼行天下 一生守护”慈善项目捐赠仪式圆满举行！

哈里斯女粉搞4B运动、毒杀丈夫，回旋镖能否让美国“血流成河”

比国产光刻机更重要的IPO要来了！

生成图片，分享到微信朋友圈

阿里达摩院新研究：实习生一作，首次实现3D物体检测精度与速度兼得

如何实现精度和速度兼得？

单阶段方法，能达到两阶段方法精度

两位共同一作，都是达摩院研究实习生

极市直播| (CVPR2020 Oral) 陈昊：超越Mask RCNN的BlendMask，实例分割新标杆

谷歌AI良心开源：一部手机就能完成3D目标检测，还是实时的那种

超全的3D视觉数据集汇总

您可能也对以下帖子感兴趣

公益慈善｜“翼行天下一生守护”慈善项目捐赠仪式圆满举行！