CVPR最佳检测:不再是方方正正的目标检测输出(附源码)

7a4b75abf1f36da0ded9c416ea602228.gif

计算机视觉研究院专栏

作者:Edison_G

有些目标往往具有任意方向的分布。因此,检测器需要更多的参数来编码方向信息,这往往是高度冗余和低效的...

525898d5a42c74f4e2b39a003502e618.png

公众号ID|ComputerVisionGzq

学习群|扫码在主页获取加入方式

f11ee09c213135ed852d060a4edd18c8.png

论文:

https://openaccess.thecvf.com/content/CVPR2021/papers/Han_ReDet_A_Rotation-Equivariant_Detector_for_Aerial_Object_Detection_CVPR_2021_paper.pdf

源代码:

https: //github.com/csuhan/ReDet

1

 简要

近年来,航空图像中的目标检测在计算机视觉中得到了广泛的关注。与自然图像中的目标不同,航空目标往往具有任意方向的分布。因此,检测器需要更多的参数来编码方向信息,这往往是高度冗余和低效的。此外,由于普通的cnn没有明确地模拟方向变化,因此需要大量的旋转增强数据来训练精确的目标检测器。

ff0aa65064da1db0ec800c72c0f57773.png

研究者提出了一种旋转等变检测器(ReDet)来解决这些问题,该检测器对旋转等变和旋转不变性进行了显式编码。更准确地说,研究者在检测器中加入旋转等变网络来提取旋转等变特征,这样可以准确地预测方向,并大大减小模型尺寸。在旋转等变特征的基础上,提出了旋转不变RoI-Align(RiRoI-Align),该算法根据RoI的方向自适应地从等变特征中提取旋转不变特征。在DOTA-v1.0、DOTA-v1.5和HRSC2016等具有挑战性的航空影像数据集上进行的大量实验表明,新提出的方法能够在航空目标检测任务上达到最先进的性能。

2

 背景

最近,许多设计良好的面向对象检测器被提出,并在具有挑战性的航空图像数据集上报告了有希望的结果。为了在无约束航空图像中实现精确的目标检测,大多数算法都致力于提取旋转不变特征。在实际应用中,旋转RoI(RRoI)扭曲(例如,rooi Pooling和rooi Align)是提取旋转不变特征最常用的方法,它可以根据二维平面上RRoI的边界框精确扭曲区域特征。然而,具有规则CNN特征的RRoI扭曲不能产生精确的旋转不变特征。通过使用更大容量的网络和更多的训练样本来模拟旋转变化,从而逼近旋转不变性。

54def740ad37e199fd9e4f6d9242078b.png

如上图所示,规则cnn与旋转不等价,即向cnn传送旋转图像与原始图像的旋转特征映射不同。因此,从常规CNN特征图中扭曲出来的区域特征通常会随着方向的变化而变得不稳定。上图所示,新提出的方法由两部分组成:旋转等变特征提取和旋转不变特征提取。首先,将旋转等变网络引入到主干网络中,生成旋转等变特征,可以准确预测方向,降低建模的复杂度。由于直接应用RRoI扭曲仍然不能从旋转等变特征中提取旋转不变特征,研究者提出了一种新的旋转不变RoI对齐算法(RiRoI-Align)。

3

 新框架

20238c507d132ea4eb2a8b22217548a5.png

(a) Overall architecture of the proposed Rotation-equivariant Detector. We first adopt the rotation-equivariant backbone to extract rotation-equivariant features, followed by an RPN and RoI Transformer (RT) to generate RRoIs. Then we use a novel Rotation-invariant RoI Align (RiRoI Align) to produce rotation-invariant features for RoI-wise classification and bounding box (bbox) regression. 

(b) Rotation-equivariant feature maps. Under the cyclic group CN , the rotation-equivariant feature maps with the size (K, N, H, W ) have N orientation channels, and each orientation channel is corresponding to an element in CN . 

(c)RiRoI Align. The proposed RiRoI Align consists of two parts: spatial alignment and orientation alignment. For an RRoI (x, y, w, h, θ), spatial alignment warps the RRoI from the spatial dimension, while orientation alignment circularly switches orientation channels and interpolates features to produce completely rotation-invariant features.

4

 实验结果

c0abfd5af9226d760727e352f7854d21.png

f03f54c32faf343c17580d8a68607a5a.png

d2eb44328771fb9c23b8075a735f6a02.png

b7ab9f5a1e3ecf3b5747c36f17cf89bd.png

b729912c8b21776b7c8b1dafc2f219d2.png

© THE END 

转载请联系本公众号获得授权

86aa42b8ee687bfd465565b3c8fba16a.gif

计算机视觉研究院学习群等你加入!

计算机视觉研究院主要涉及深度学习领域,主要致力于人脸检测、人脸识别,多目标检测、目标跟踪、图像分割等研究方向。研究院接下来会不断分享最新的论文算法新框架,我们这次改革不同点就是,我们要着重”研究“。之后我们会针对相应领域分享实践过程,让大家真正体会摆脱理论的真实场景,培养爱动手编程爱动脑思考的习惯!

6bdf2e57258edc7b3f0c91ba0218cfd8.png

扫码关注

计算机视觉研究院

公众号ID|ComputerVisionGzq

学习群|扫码在主页获取加入方式

 往期推荐 

🔗

  • 0
    点赞
  • 3
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

计算机视觉研究院

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值