Swin-Transformer详解
0. 前言
Swin-Transformer是2021年微软研究院发表在ICCV上的一篇文章,并且已经获得ICCV 2021 best paper
的荣誉称号。虽然Vision Transformer (ViT)
在图像分类方面的结果令人鼓舞,但是由于其低分辨率特性映射和复杂度随图像大小的二次增长
,其结构不适合作为密集视觉任务
或高分辨率输入图像
的通过骨干网路。为了最佳的精度和速度的权衡
,提出了Swin-Transformer结构。
论文名称:Swin Transformer: Hierarchical Vision Transformer using Shifted Windows
原论文地址: https://arxiv.org/abs/2103.14030
官方开源代码地址:https://github.com/microsoft/Swin-Transformer
Pytorch实现代码