知识蒸馏之Focal and Global Knowledge Distillation for Detectors

该文章探讨了在目标检测任务中,传统知识蒸馏方法的局限性,尤其是背景和前景特征差异导致的问题。作者提出了全局和局部蒸馏方法,通过分离前景和背景并重建像素间联系,提升学生模型的学习效果。局部蒸馏利用改进的掩模和注意力机制,全局蒸馏则关注特征间的全局信息传递。模型结构包括特征损失和注意力损失两部分,旨在优化学生模型对教师模型知识的吸收。
摘要由CSDN通过智能技术生成

cvpr2021
Zhendong Yang*1,2 Zhe Li2 Xiaohu Jiang1 Y uan Gong1
Zehuan Y uan2 Danpei Zhao3 Chun Y uan†1
1Tsinghua Shenzhen International Graduate School 2ByteDance Inc
3BeiHang University

0.摘要

作者觉得在目标检测领域,知识蒸馏效果比较差,其原因是教师和学生的特征在背景和前景中差距比较大。如果蒸馏的温度一样,会产生吸收大量噪音负面影响。
作者提出了全局和局部蒸馏,局部蒸馏会分离前后景(语义分割?),来让学生关注老师的精华。而全局蒸馏会重建不同像素之间的联系,填充全局信息。

1.模型结构

请添加图片描述

1.1局部蒸馏

请添加图片描述
很简单,r为gt_box,只有这一块是1。
由于前后景不均衡,对mask进行了改进:
请添加图片描述
然后加了空间和通道注意力:
请添加图片描述
损失包括两部分,特征损失
是和注意力损失:
请添加图片描述

1.2全局蒸馏

请添加图片描述
请添加图片描述
请添加图片描述

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值