[论文笔记]Multi-View 3D Object Detection Network for Autonomous Driving

最新推荐文章于 2024-08-02 18:09:17 发布

CwwwwS

最新推荐文章于 2024-08-02 18:09:17 发布

阅读量2.8k

点赞数 3

分类专栏：笔记文章标签：目标检测 3d 计算机视觉

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_43146899/article/details/121779448

版权

本文介绍了一种结合视觉和雷达点云信息的多模态3D对象检测网络，用于自动驾驶。该网络通过俯视图和前视图减少计算量，同时保持信息丰富。在特征提取后计算候选区域并进行融合，实现在KITTI数据集上的优秀性能，优于基于激光雷达和图像的3D检测方法。

摘要由CSDN通过智能技术生成

Multi-View 3D Object Detection Network for Autonomous Driving

本文提出一种多模态的3D目标检测，融合了视觉和雷达点云信息。和以往基于voxel的方法不同，它只用了点云的俯视图和前视图，这样既能减少计算量，又不至于丧失过多的信息。随后生成3D候选区域，把特征和候选区域融合后输出最终的目标检测框。

作者认为基于LIDAR点云的方法通常可以获得更准确的3D目标位置，而基于图像的方法就2D目标评估具有更高的精度。

整体架构如下图所示，多模态3D检测网络由两部分组成：特征提取网络和信息融合网络。

请添加图片描述

下面对整个架构进行拆解

1）特征提取

a. 提取点云俯视图特征信息

俯视图由高度、强度、密度组成，投影到分辨率为0.1的二维网格中。

对于每个网格来说，高度特征有点云单元格中的最高值得出；为了编码更多的高度特征，点云被分为M块，每一个块都计算相应的高度图，从而获得了M个高度图。

强度是每个单元格中有最大高度的点的映射值。

密度表示每个单元格中点的数目，为了归一化特征，被计算为：

最低0.47元/天解锁文章

关注

3
点赞
踩
6

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。