复现代码的过程中,简单了解了作者使用的数据集CIFAR-10 dataset ,简单记录一下。
CIFAR-10数据集是8000万微小图片的标签子集,它的收集者是:Alex Krizhevsky, Vinod Nair, Geoffrey Hinton。
数据集由6万张32*32的彩色图片组成,一共有10个类别。每个类别6000张图片。其中有5万张训练图片及1万张测试图片。
数据集被划分为5个训练块和1个测试块,每个块1万张图片。
测试块包含了1000张从每个类别中随机选择的图片。训练块包含随机的剩余图像,但某些训练块可能对于一个类别的包含多于其他类别,训练块包含来自各个类别的5000张图片。
这些类是完全互斥的,及在一个类别中出现的图片不会出现在其它类中。
数据集版本
作者提供了3个版本的数据集:python version; Matlab version; binary version。
可根据自己的需求选择。
数据集下载地址:下载链接
数据集布置
以python version进行介绍,Matlab version与之相同。
下载后获得文件 data_batch_1, dat
CIFAR-10 数据集简介
最新推荐文章于 2023-06-14 21:16:18 发布
![](https://img-home.csdnimg.cn/images/20240711042549.png)