《python神经网络编程》学习笔记

第二章使用python进行DIY——学习笔记

2.5 手写数字的数据集MNIST

书中代码为

data_file = open("mnist_dataset/mnist_train_100.csv",'r')
#open()打开文件
#r:只读方式避免更改数据或删除数据
#mnist_dataset:文件目录
#mnist_train_100.csv:整个路径

data_list = data_file.readlines()
#文件中所有变量读入变量data_list
#readlines()文件读取内容

data_file.close()
#关闭文件

遇到无法读取.csv文件

2.5.1 书中链接无法下载

当时从网站下载下载数据集,http://yann.lecun.com/exdb/mnist/

下载的格式是.gz格式

官网下载界面​

 需要将官网下载数据转化为.CSV格式,直接将代码放到pycharm中运行即可。

def convert(imgf: object, labelf: object, outf: object, n: object) -> object:
    f = open(imgf, "rb")
    o = open(outf, "w")
    l = open(labelf, "rb")

    f.read(16)
    l.read(8)
    images = []

    for i in range(n):
        image = [ord(l.read(1))]
        for j in range(28 * 28):
            image.append(ord(f.read(1)))
        images.append(image)

    for image in images:
        o.write(",".join(str(pix) for pix in image) + "\n")
    f.close()
    o.close()
    l.close()


convert("mnist_dataset/train-images.idx3-ubyte", "mnist_dataset/train-labels.idx1-ubyte","mnist_train.csv", 60000)
#注意修改文件名
convert("mnist_dataset/t10k-images.idx3-ubyte", "mnist_dataset/t10k-labels.idx1-ubyte","mnist_test.csv", 10000)
#注意修改文件名


print("Convert Finished!")

之后便可以将.gz格式转化为.csv格式

2.5.2 jupyter无法读取.csv格式

变代码

import pandas as pd
data_file = pd.read_csv('mnist_train.csv',header=0,encoding="gbk")
print(data_file)

 注意:在jupyter中显示的.csv文件是什么样的

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 2
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值