本文转载自知乎,作者来自媒智科技,介绍了其今天刚刚开源的人脸检测工程TinaFace,已获作者授权转载,请勿二次转载。
https://zhuanlan.zhihu.com/p/315511581
这几年人脸检测的benchmark越刷越高,方法也越来越复杂,提出的模块或者方法大都专门为人脸检测设计,不易复现和使用,比如DSFD里的FEM、PAL、IAM,ASFD里的AutoFEM、PAL、IAM、DRMC loss,HAMBox里的PA、OAM、RAL等等。
鉴于此,我们设计了一个简单而又强大的人脸检测模型——TinaFace,该模型基于RetinaNet,相比RetinaNet只做了很小的改动:
将BN换成GN;
加了一个IoU预测分支;
在backbone上嵌入了DCNv1;
将框回归的loss从smooth l1 loss替换为DIoU loss。
在仅使用ResNet50作为backbone的情况下,TinaFace在WIDER FACE的验证集和测试集中的hard上达到了当前的state of the art。我们只看hard的原因在于WIDER FACE的easy和medium都包含在hard之中,hard体现的是一个人脸检测器在所有人脸上的检测效果。
具体来说,在单模型,backbone仅为ResNet50的情况下:
1、验证集上
1.1、不使用TTA的TinaFace:TinaFace的AP为93.0%,比基于ResNet152的ASFD(使用TTA)高0.5%,比基于ResNet152的DSFD(使用TTA)高1.8%;
1.2、使用TTA的TinaFace:TinaFace的AP为93.4%,比基于ResNet50的HAMBox(使用TTA)高0.1%。
2、测试集上
2.1、不使用TTA的TinaFace:TinaFace的AP为92.1%,与基于ResNet152的ASFD(使用TTA)一样,比基于ResNet152的DSFD(使用TTA)高2.1%;
2.2、使用TTA的TinaFace:TinaFace的AP为92.4%,比基于ResNet50的HAMBox(使用TTA)高0.1%。
TinaFace非常简单,基于RetinaNet,所添加的模块在在通用的目标检测框架(比如mmdetection、vedadet)中都是现成的。而且训练不需要大batch,即使你的显存只有11G,也可以复现TinaFace。也正因为TinaFace使用的模块都非常经典、成熟,TinaFace也会比较容易部署。
我们的代码开源地址在文末,基于vedadet,里面提供当前最好结果的权重,以及训练、测试、推理代码,无论大家是想做研究、打比赛、还是仅仅想体验state of the art的效果,这个repo都能满足你。
vedadet能做到的不仅于此,vedadet是我们基于mmdetection开发的单阶段目标检测框架,适用任意目标检测任务,无论是人脸检测还是通用目标检测。
vedadet提供训练、测试、推理特性,后续会支持转ONNX/TensorRT,以及基于TensorRT的Python前端SDK或者C++前端SDK。
想了解实验细节的朋友可以参见论文TinaFace: Strong but Simple Baseline for Face Detection (文末附下载)。实验中使用的数据分析工具我们也开源了——volkscv。
TinaFace 代码:
https://github.com/Media-Smart/vedadet/tree/main/configs/trainval/tinaface
volksdep: 一个实用TensorRT部署和加速PyTorch、Onnx和TensorFlow模型的开源库
https://github.com/Media-Smart/volksdep
FlexInfer:一个灵活的Python前端推断库
https://github.com/Media-Smart/flexinfer
cheetahinfer:一个基于TensorRT的纯C++推断SDK
https://github.com/Media-Smart/cheetahinfer
vedadet:一个基于PyTorch的单阶段目标检测工具箱
https://github.com/Media-Smart/vedadet
volkscv:一个计算机视觉研究与部署的基础Python库
https://github.com/Media-Smart/volkscv
论文下载:
论文目前还没有公开arXiv地址,在我爱计算机视觉 公众号后台回复“tinaface”,即可收到PDF下载。
END
备注:人脸
人脸技术交流群
人脸检测、识别、对齐、重建、表情识别、表情迁移等技术,
若已为CV君其他账号好友请直接私信。
我爱计算机视觉
微信号:aicvml
QQ群:805388940
微博知乎:@我爱计算机视觉
投稿:amos@52cv.net
网站:www.52cv.net
在看,让更多人看到