pytorch实战-基于LeNet5网络结构

这篇博客介绍了如何在PyTorch中使用LeNet5网络结构进行实践。内容包括主要库包Torchvision和DataLoader的解释,CIFAR10数据集的获取,以及LeNet5网络结构的详细说明。通过实例代码展示了LeNet5.py和main.py的实现,包括数据加载、网络定义和损失计算等步骤。
摘要由CSDN通过智能技术生成

此博文用到的CIFAR10数据集,可从官网下载:官网入口
但是官网下载实在是太慢啦,这里贴一个百度云链接哈哈十分钟的事情嘛,百度云:链接入口
此博文用到的卷积网络结构为LeNet5,比较久远,但是为了pytorch练手嘛可以试试,加深理解。

LeNet 5卷积神经网络结构如下图:
图1 LeNet 5卷积神经网络结构在这里插入图图1片描述

一、主要库包理解与解释

torchvision详细介绍:参考博文入口

(1) Torchvision

torchvision是独立于pytorch的关于图像操作的一些方便工具库.

  • vision.datasets :
    几个常用视觉数据集(MINIST,CIFAR),可以下载和加载,这里主要的高级用法就是可以看源码如何自己写自己的Dataset的子类
  • vision.models : 流行的模型,例如 AlexNet, VGG, ResNet 和 Densenet 以及 与训练好的参数。
  • vision.transforms : 常用的图像操作,例如:随机切割,旋转,数据类型转换,图像到tensor ,numpy
    数组到tensor , tensor 到 图像等。
  • vision.utils : 用于把形似 (3 x H x W) 的张量保存到硬盘中,给一个mini-batch的图像可以产生一个图像格网

MINIST数据

dset.MNIST(root, train=True, transform=None, target_transform=None, download=False)
  1. root:数据的目录,里边有 processed/training.pt 和processed/test.pt 的内容
  2. train: True -使用训练集, False -使用测试集.
  3. transform: 给输入图像施加变换
  4. target_transform:给目标值(类别标签)施加的变换
  5. download: 是否下载mnist数据集,下载到root中指定的目录

CIFAR数据集
cifar10表示10个图片分类种类;cifar100将图片更加细分为100个分类情况
如下图所示:
在这里插入图片描述

dset.CIFAR10(root, train=True, transform=None, target_transform=None, download=False)
dset.CIFAR100(root, train=True, transform=None, target_transform=None, download=False)
  1. root : 数据的目录,存放 cifar-10-batches-py数据集
  2. train :True -使用训练集, False -使用测试集.
  3. download : 是否下载mnist数据集,下载到root中指定的目录
(2)DataLoader

从DataLoader类的属性定义中可以看出,这个类的作用就是实现数据以什么方式输入到什么网络中

下面具体研究一下:

先看看 dataloader.py脚本是怎么写的(VS中按F12跳转到该脚本)

init(构造函数)中的几个重要的属性:

  1. dataset:(数据类型 dataset)

    输入的数据类型。看名字感觉就像是数据库,C#里面也有dataset类,理论上应该还有下一级的datatable。这应当是原始数据的输入。PyTorch内也有这种数据结构。这里先不管,估计和C#的类似,这里只需要知道是输入数据类型是dataset就可以了。

  2. batch_size:(数据类型 int)

    每次输入数据的行数,默认为1。PyTorch训练模型时调用数据不是一行一行进行的(这样太没效率),而是一捆一捆来的。这里就是定义每次喂给神经网络多少行数据,如果设置成1,那就是一行一行进行。

  3. shuffle:(数据类型 bool)

    洗牌。默认设置为False。在每次迭代训练时是否将数据洗牌,默认设置是False。将输入数据的顺序打乱,是为了使数据更有独立性,但如果数据是有序列特征的,就不要设置成True了。

  4. collate_fn:(数据类型 callable,没见过的类型)

    将一小段数据合并成数据列表,默认设置是False。如果设置成True,系统会在返回前会将张量数据(Tensors)复制到CUDA内存中。(不太明白作用是什么,就暂时默认False)

  5. batch_sampler:(数据类型 Sampler)

    批量采样,默认设置为None。但每次返回的是一批数据的索引(注意:不是数据)。其和batch_size、shuffle 、sampler
    and
    drop_last参数是不兼容的。我想,应该是每次输入网络的数据是随机采样模式,这样能使数据更具有独立性质。所以,它和一捆一捆按顺序输入,数据洗牌,数据采样,等模式是不兼容的。

  6. sampler:(数据类型 Sampler)

    采样,默认设置为None。根据定义的策略从数据集中采样输入。如果定义采样规则,则洗牌(shuffle)设置必须为False。

  7. num_workers:(数据类型 Int)

    工作者数量,默认是0。使用多少个子进程来导入数据。设置为0,就是使用主进程来导入数据。注意:这个数字必须是大于等于0的,负数估计会出错。

  8. pin_memory:(数据类型 bool)

    内存寄存,默认为False。在数据返回前,是否将数据复制到CUDA内存中。

  9. drop_last:(数据类型 bool)

    丢弃最后数据,默认为False。设置了 batch_size
    的数目后,最后一批数据未必是设置的数目,有可能会小些。这时你是否需要丢弃这批数据。

  10. timeout:(数据类型 numeric)

    超时,默认为0。是用来设置数据读取的超时时间的,但超过这个时间还没读取到数据的话就会报错。 所以,数值必须大于等于0。

  11. worker_init_fn(数据类型 callable,没见过的类型)

    子进程导入模式,默认为Noun。在数据导入前和步长结束后,根据工作子进程的ID逐个按顺序导入数据。

利用CIFAR 10数据集举例代码如下:

 batchsz = 128

    cifar_train = datasets.CIFAR10('cifar', True, transform=transforms.Compose([
        transforms.Resize((32, 32)),
        transforms.ToTensor(),
        transforms.Normalize
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值