torch.utils.data.DataLoader与迭代器转换操作

Zada ·

更新时间:2024-09-20

· 1967 次阅读

在做实验时，我们常常会使用用开源的数据集进行测试。而Pytorch中内置了许多数据集，这些数据集我们常常使用DataLoader类进行加载。
如下面这个我们使用DataLoader类加载torch.vision中的FashionMNIST数据集。

from torch.utils.data import DataLoader
from torchvision import datasets
from torchvision.transforms import ToTensor
import matplotlib.pyplot as plt
training_data = datasets.FashionMNIST(
    root="data",
    train=True,
    download=True,
    transform=ToTensor()
)
test_data = datasets.FashionMNIST(
    root="data",
    train=False,
    download=True,
    transform=ToTensor()
)

我们接下来定义Dataloader对象用于加载这两个数据集：

train_dataloader = DataLoader(training_data, batch_size=64, shuffle=True)
test_dataloader = DataLoader(test_data, batch_size=64, shuffle=True)

那么这个train_dataloader究竟是什么类型呢？

print(type(train_dataloader))  # <class 'torch.utils.data.dataloader.DataLoader'>

我们可以将先其转换为迭代器类型。

print(type(iter(train_dataloader)))# <class 'torch.utils.data.dataloader._SingleProcessDataLoaderIter'>

然后再使用next(iter(train_dataloader))从迭代器里取数据，如下所示：

train_features, train_labels = next(iter(train_dataloader))
print(f"Feature batch shape: {train_features.size()}")
print(f"Labels batch shape: {train_labels.size()}")
img = train_features[0].squeeze()
label = train_labels[0]
plt.imshow(img, cmap="gray")
plt.show()
print(f"Label: {label}")

可以看到我们成功获取了数据集中第一张图片的信息，控制台打印：

Feature batch shape: torch.Size([64, 1, 28, 28])
Labels batch shape: torch.Size([64])
Label: 2

图片可视化显示如下：

不过有读者可能就会产生疑问，很多时候我们并没有将DataLoader类型强制转换成迭代器类型呀，大多数时候我们会写如下代码：

for train_features, train_labels in train_dataloader: 
    print(train_features.shape) # torch.Size([64, 1, 28, 28])
    print(train_features[0].shape) # torch.Size([1, 28, 28])
    print(train_features[0].squeeze().shape) # torch.Size([28, 28])
    img = train_features[0].squeeze()
    label = train_labels[0]
    plt.imshow(img, cmap="gray")
    plt.show()
    print(f"Label: {label}")

可以看到，该代码也能够正常迭代训练数据，前三个样本的控制台打印输出为：

torch.Size([64, 1, 28, 28])
torch.Size([1, 28, 28])
torch.Size([28, 28])
Label: 7
torch.Size([64, 1, 28, 28])
torch.Size([1, 28, 28])
torch.Size([28, 28])
Label: 4
torch.Size([64, 1, 28, 28])
torch.Size([1, 28, 28])
torch.Size([28, 28])
Label: 1

那么为什么我们这里没有显式将Dataloader转换为迭代器类型呢，其实是Python语言for循环的一种机制，一旦我们用for ... in ...句式来迭代一个对象，那么Python解释器就会偷偷地自动帮我们创建好迭代器，也就是说

for train_features, train_labels in train_dataloader:

实际上等同于

for train_features, train_labels in iter(train_dataloader):

更进一步，这实际上等同于

train_iterator = iter(train_dataloader)
try:
    while True:
        train_features, train_labels = next(train_iterator)
except StopIteration:
    pass

推而广之，我们在用Python迭代直接迭代列表时：

for x in [1, 2, 3, 4]:

其实Python解释器已经为我们隐式转换为迭代器了：

list_iterator = iter([1, 2, 3, 4])
try:
    while True:
        x = next(list_iterator)
except StopIteration:
    pass

到此这篇关于torch.utils.data.DataLoader与迭代器转换操作的文章就介绍到这了,更多相关torch.utils.data.DataLoader与迭代器转换内容请搜索软件开发网以前的文章或继续浏览下面的相关文章希望大家以后多多支持软件开发网！

data 迭代 torch 迭代器

1024 个赞

需要登录后方可回复, 如果你还没有账号请注册新账号

HTML5 input新增type属性color颜色拾取器的实例代码

Fiorenza 2020-01-27

630

Golang教程之不可重入函数的实现方法

Vanora 2020-10-01

676

IIS重定向使用图文教程

Natalie 2020-05-03

618

javascript事件监听与事件委托实例详解

Flower 2021-02-17

704

python自动化测试中装饰器@ddt与@data源码深入解析

Serafina 2022-12-11

382

mysql数据如何通过data文件恢复

Kitty 2022-12-15

1033

Python中的迭代器与生成器使用及说明

Malina 2022-12-17

Pythonpandas的索引方式data.loc[],data[][]示例详解

Catherine 2023-02-16

453

解决mysql报错:Data source rejected establishment of connection, message from server: \Too many connectio

Wenda 2023-02-18

469

详解JS前端使用迭代器和生成器原理及示例

Tani 2023-02-22

1861

C++迭代器失效问题及解决

Belle 2023-02-25

1712

pandas.DataFrame的for循环迭代的实现

Chynna 2023-02-26

464

mysql实现将data文件直接导入数据库文件

Kefira 2023-03-09

1460

浅谈C++反向迭代器的设计

Rosine 2023-05-12

1050

Vue中data数据初始化方法详解

Radinka 2023-05-12

1973

Go设计模式之迭代器模式讲解和代码示例

Dulcea 2023-07-17

599

python中的torch常用tensor处理函数示例详解

Ursula 2023-07-20

1925

C#语言async await之迭代器工作原理示例解析

Jacinthe 2023-07-22

549

我要提问

致谢

帮助他人，成就自己。

人生最大成功就是伸出热情而温暖的双手，尽自己所能去帮助身边的每一个人，只要无私的奉献，就会收获到美好的生活。

1024问感谢每一位朋友的帮助和支持。

软件开发网提供编程的基础软件技术培训教程,软件开发编程实例讲解Go,Node,HTML,CSS,Javascript,Python,Java,Ruby,C,PHP,MySQL等软件开发编程语言以及数据开发的基础知识，也提供大量的软件开发在线实例、从入门到精通就在1024问。

育儿网微养生全球行美食街育儿菜谱大全海南旅游女性养狗百科星座