1. MS-Celeb-1M数据集
MSR IRC是目前世界上规模最大、水平最高的图像识别赛事之一,由MSRA(微软亚洲研究院)图像分析、大数据挖掘研究组组长张磊发起,每年定期举办。从1M个名人中,根据他们的受欢迎程度,选择100K个。然后,利用搜索引擎,给100K个人,每人搜大概100张图片。共100K*100=10M个图片。测试集包括1000个名人,这1000个名人来自于1M个明星中随机挑选。而且经过微软标注。每个名人大概有20张图片,这些图片都是网上找不到的。数据有对齐版可以直接用于训练(共80G数据)。
https://blog.csdn.net/qq_34106574/article/details/82770647
2. CAISA-WebFace,VGG-Face, MegaFace,LFW