论文阅读——Vision Transformer with Deformable Attention

最新推荐文章于 2025-01-08 03:00:00 发布

じんじん

最新推荐文章于 2025-01-08 03:00:00 发布

阅读量1.6k

点赞数 25

分类专栏：论文文章标签：算法人工智能

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_43575791/article/details/134363745

版权

文章介绍了一种新的视觉注意力模型——可变形注意力，它通过学习性偏移在网络中共享关键点和值，有效降低空间复杂度，特别是在处理大型特征图时。与DeformableDETR不同，可变形注意力作为特征提取器，能够在视觉任务中提高性能，通过可视化结果展示了其在定位目标对象和聚焦关键区域的能力。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

Vision Transformer with Deformable Attention

多头自注意力公式化为：

第l层transformer模块公式化为：

在Transformer模型中简单地实现DCN是一个non-trivial的问题。在DCN中，特征图上的每个元素都单独学习其偏移，其中H×W×C特征图上3×3可变形卷积的空间复杂度为9HW C。如果我们在注意力模块中直接应用相同的机制，空间复杂度将急剧上升到NqNkC，其中Nq，Nk是查询和密钥的数量，通常具有与特征图大小HW相同的比例，带来近似双二次复杂度。尽管Deformable DETR已经通过在每个尺度上设置较低数量的密钥（Nk＝4）来减少这种开销，并且作为检测头工作得很好，但由于信息的不可接受的丢失，在骨干网络中处理如此少的密钥是不好的（见附录中的详细比较）。同时

最低0.47元/天解锁文章

博客等级

码龄7年

170
原创

715
点赞

816
收藏

506
粉丝

关注

私信

热门文章

分类专栏

杂七杂八 7篇
论文 68篇
数学 12篇
data structures 5篇
机器学习 21篇
计算机编程 17篇
强化学习 3篇
计算机视觉 1篇
NLP 14篇
3D 8篇
深度学习 9篇
射影几何 5篇

展开全部收起

最新评论

矩阵分析及应用（1-2章）
jack_tony70: 請問這是哪本書呢？還是書名就叫做「矩陣分析及應用」？
论文阅读——Unified Generative Adversarial Networks for Controllable Image-to-Image Translation
普通网友: 写的很好，细节很到位！【我也写了一些相关领域的文章，希望能够得到博主的指导，共同进步！】
论文阅读——Unified Generative Adversarial Networks for Controllable Image-to-Image Translation
CSDN-Ada助手: 你好，CSDN 开始提供 #论文阅读# 的列表服务了。请看：https://blog.csdn.net/nav/advanced-technology/paper-reading?utm_source=csdn_ai_ada_blog_reply 。如果你有更多需求，请来这里 https://gitcode.net/csdn/csdn-tags/-/issues/34?utm_source=csdn_ai_ada_blog_reply 给我们提。
论文阅读——MVDiffusion
CSDN-Ada助手: 你好，CSDN 开始提供 #论文阅读# 的列表服务了。请看：https://blog.csdn.net/nav/advanced-technology/paper-reading?utm_source=csdn_ai_ada_blog_reply 。如果你有更多需求，请来这里 https://gitcode.net/csdn/csdn-tags/-/issues/34?utm_source=csdn_ai_ada_blog_reply 给我们提。
论文阅读——Sat2Vid
CSDN-Ada助手: 你好，CSDN 开始提供 #论文阅读# 的列表服务了。请看：https://blog.csdn.net/nav/advanced-technology/paper-reading?utm_source=csdn_ai_ada_blog_reply 。如果你有更多需求，请来这里 https://gitcode.net/csdn/csdn-tags/-/issues/34?utm_source=csdn_ai_ada_blog_reply 给我们提。

大家在看

最新文章

目录

展开全部

收起

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。