标定神器 | 实例分割自动标定(英伟达&复旦)

作者 | 平山海  编辑 | CV51

点击下方卡片,关注“自动驾驶之心”公众号

ADAS巨卷干货,即可获取

点击进入→自动驾驶之心【分割】技术交流群

后台回复【分割综述】获取语义分割、实例分割、全景分割、弱监督分割等超全学习资料!

简述:基于Transformer构建了分割自动标注器,用于产生分割标注作为实例分割算法的监督信息,基于生成的标注训练实例分割网络,分割效果达到了全监督的97.4%。

2d36a80cc4e076c252b553296f860237.png
  • 论文:Vision Transformers Are Good Mask Auto-Labelers

  • 开源代码:https://github.com/NVlabs/mask-auto-labeler

  • 单位:英伟达、Meta AI、复旦大学等

手工标注实例分割标签,价格高、耗时长,且不容易控制标注质量。因此可以用box监督分割算法的训练。作者基于Transformer构建了分割自动标注器(Mask Auto-Labeler,简称MAL),用于在box监督下产生分割标注,作为实例分割算法的监督信息。

自动生成的实例分割标签示例如下:

d5fe7cae7f4bc8ec5ee35233846237f4.png

作者使用了2阶段框架:

  • 阶段1:分割标签自动标注 该阶段使用MAL产生高质量的分割标注。MAL的输入为Box区域,而非整张图,以提高小目标的分辨率。

  • 阶段2:实例分割算法训练 利用阶段1生成的分割标注作为监督信息,训练实例分割算法。这里能使用各种实例分割算法进行训练。

如下图所示:

6394a2a3d9e782a1b7448eabb0fdfec0.png

1.MAL输入样本的生成

将box进行扩张,得到MAL的输入样本,如下图所示。其中,原始box的部分为正样本,扩张的部分全部是背景信息,为负样本。

94c265a33c95333897f8090ed86ecbb2.png

在box扩张时,引入了一定的随机性:

0fb4c73cdc54fe23fb46ddb27d759c14.png

2.MAL架构

MAL的网络结构包含2部分,其一为task网络,其二为teacher网络,两者结构相同。两者均包含Image Encoder(记作E)和Mask Decoder(记作D)。如下图所示:

5f56ccf84e26c46bb57c72ada9c36ddc.png
  • Image Encoder

使用标准的ViT结构,去掉分类head。

  • Mask Decoder

借鉴YOLACT,使用了注意力机制网络,包含instance-aware head 和pixel-wise head :,其中表示内积。

d0c264efd6422dfc81743a24760f6530.png

teacher网络不直接参与训练,而是借鉴MOCO的思路,利用task网络的权重使用EMA(exponential moving averages)的方法更新teacher网络的参数,以防止loss为Nan,保证训练的稳定性。

3.损失函数

使用了Multiple Instance Learning Loss和Conditional Random Field Loss。

  • Multiple Instance Learning Loss:目的是保证box紧贴目标。

f83ba895514f296d8a115fd8915ebcdc.png
  • Conditional Random Field Loss:通过能量最小化精炼mask的预测。

e294e02b05ac0e8d6dddb4e18b380606.png 2ae0564343cf3f319c463364372553af.png

4.实验结果

d72983d8b6dd788212244d48020b13c9.png 02e0c5220c772180b2e08cb40045b3ed.png bcf9ccc8697071d5918a32851feaf406.png

7f66fd457b08bf63224108ab1f78bbd8.png

自动驾驶之心】全栈技术交流群

自动驾驶之心是首个自动驾驶开发者社区,聚焦目标检测、语义分割、全景分割、实例分割、关键点检测、车道线、目标跟踪、3D目标检测、BEV感知、多传感器融合、SLAM、光流估计、深度估计、轨迹预测、高精地图、NeRF、规划控制、模型部署落地、自动驾驶仿真测试、硬件配置、AI求职交流等方向;

ded2839cb19e92b87732b52e03013d02.jpeg

添加汽车人助理微信邀请入群

备注:学校/公司+方向+昵称

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值