用Python3.x解析CIFAR-10数据集图片

最新推荐文章于 2021-05-23 01:48:30 发布

一摩尔自由

最新推荐文章于 2021-05-23 01:48:30 发布

阅读量802

点赞数

分类专栏：机器学习文章标签： cifar10

本文链接：https://blog.csdn.net/Barry_J/article/details/79165171

版权

本文介绍了如何使用Python3.x解析CIFAR-10数据集，包括数据集的结构、标签含义以及如何将数据转换为图像。通过示例代码展示了如何将CIFAR-10数据集的图像可视化，并提供了数据下载链接和相关资源。

摘要由CSDN通过智能技术生成

用Python3.x解析CIFAR-10数据集图片

在学习tensorflow的mnist和cifar实例的时候,官方文档给出的讲解都是一张张图片,直观清晰,当我们看到程序下载下来的数据的时候,都是二进制文件,这些二进制文件还不小,用文本编辑器打开看也看不懂,要是将数据再现为图像

(1)CIFAR-10数据集介绍

① CIFAR-10数据集包含60000个32*32的彩色图像，共有10类。有50000个训练图像和10000个测试图像。
数据集分为5个训练块和1个测试块，每个块有10000个图像。测试块包含从每类随机选择的1000个图像。训练块以随机的顺序包含这些图像，但一些训练块可能比其它类包含更多的图像。训练块每类包含5000个图像。
②data——1个10000*3072大小的uint8s数组。数组的每行存储1张32*32的图像。第1个1024包含红色通道值，下1个包含绿色，最后的1024包含蓝色。图像存储以行顺序为主，所以数组的前32列为图像第1行的红色通道值。
labels——1个10000数的范围为0~9的列表。索引i的数值表示数组data中第i个图像的标签。
③数据集中包含另外1个叫batches.meta的文件。它也包含1个Python字典对象。有如下列元素：
label_names——1个10元素的列表，给labels中的数值标签以有意义的名称。例如，label_names[0] == “airplane”, label_names[1] == “automobile”等。

(2)下载python版本的cifar数据