PyTorch入门学习：torch.utils.data.DataLoader

最新推荐文章于 2024-05-17 17:18:13 发布

山上有只羊M

最新推荐文章于 2024-05-17 17:18:13 发布

阅读量5.7k

点赞数 4

分类专栏：深度学习 pytorch

本文链接：https://blog.csdn.net/shanshangyouzhiyangM/article/details/83818592

版权

PyTorch中数据读取的一个重要接口是torch.utils.data.DataLoader。只要是用PyTorch来训练模型基本都会用到该接口，该接口主要用来将自定义的数据读取接口的输出或者PyTorch已有的数据读取接口的输入按照batch size封装成Tensor，后续只需要再包装成Variable即可作为模型的输入，因此该接口有点承上启下的作用，比较重要。__init__中的几个重...

摘要由CSDN通过智能技术生成

介绍

PyTorch中数据读取的一个重要接口是torch.utils.data.DataLoader。

只要是用PyTorch来训练模型基本都会用到该接口，该接口主要用来将自定义的数据读取接口的输出或者PyTorch已有的数据读取接口的输入按照batch size封装成Tensor，后续只需要再包装成Variable即可作为模型的输入，因此该接口有点承上启下的作用，比较重要。

init中的几个重要的输入：

1、dataset，这个就是PyTorch已有的数据读取接口（比如torchvision.datasets.ImageFolder）或者自定义的数据接口的输出，该输出要么是torch.utils.data.Dataset类的对象，要么是继承自torch.utils.data.Dataset类的自定义类的对象。
2、batch_size，根据具体情况设置即可。
3、shuffle，一般在训练数据中会采用。
4、collate_fn，是用来处理不同情况下的输入dataset的封装，一般采用默认即可，除非你自定义的数据读取输出非常少见。
5、batch_sampler，从注释可以看出，其和batch_size、shuffle等参数是互斥的，一般采用默认。
6、sampler，从代码可以看出，其和shuffle是互斥的，一般默认即可。
7、num_workers，从注释可以看出这个参数必须大于等于0，0的话表示数据导入在主进程中进行，其他大

最低0.47元/天解锁文章

山上有只羊M

关注

4
点赞
踩
17

收藏

觉得还不错? 一键收藏
4
评论
PyTorch入门学习：torch.utils.data.DataLoader

PyTorch中数据读取的一个重要接口是torch.utils.data.DataLoader。只要是用PyTorch来训练模型基本都会用到该接口，该接口主要用来将自定义的数据读取接口的输出或者PyTorch已有的数据读取接口的输入按照batch size封装成Tensor，后续只需要再包装成Variable即可作为模型的输入，因此该接口有点承上启下的作用，比较重要。__init__中的几个重...
复制链接

扫一扫