我对PyTorch dataloader里的shuffle=True的理解

Lacie ·

更新时间:2024-09-20

· 454 次阅读

对shuffle=True的理解：

之前不了解shuffle的实际效果，假设有数据a,b,c,d，不知道batch_size=2后打乱，具体是如下哪一种情况：

1.先按顺序取batch，对batch内打乱，即先取a,b，a,b进行打乱；

2.先打乱，再取batch。

证明是第二种


shuffle (bool, optional): set to ``True`` to have the data reshuffled 
at every epoch (default: ``False``).
if shuffle:
    sampler = RandomSampler(dataset) #此时得到的是索引

补充：简单测试一下pytorch dataloader里的shuffle=True是如何工作的

看代码吧~


import sys
import torch
import random
import argparse
import numpy as np
import pandas as pd
import torch.nn as nn
from torch.nn import functional as F
from torch.optim import lr_scheduler
from torchvision import datasets, transforms
from torch.utils.data import TensorDataset, DataLoader, Dataset
class DealDataset(Dataset):
    def __init__(self):
        xy = np.loadtxt(open('./iris.csv','rb'), delimiter=',', dtype=np.float32)
        #data = pd.read_csv("iris.csv",header=None)
        #xy = data.values
        self.x_data = torch.from_numpy(xy[:, 0:-1])
        self.y_data = torch.from_numpy(xy[:, [-1]])
        self.len = xy.shape[0]
    def __getitem__(self, index):
        return self.x_data[index], self.y_data[index]
    def __len__(self):
        return self.len
dealDataset = DealDataset() 
train_loader2 = DataLoader(dataset=dealDataset,
                          batch_size=2,
                          shuffle=True)
#print(dealDataset.x_data)
for i, data in enumerate(train_loader2):
    inputs, labels = data
    #inputs, labels = Variable(inputs), Variable(labels)
    print(inputs)
    #print("epoch：", epoch, "的第" , i, "个inputs", inputs.data.size(), "labels", labels.data.size())

简易数据集

shuffle之后的结果，每次都是随机打乱，然后分成大小为n的若干个mini-batch.

以上为个人经验，希望能给大家一个参考，也希望大家多多支持软件开发网。

pytorch true shuffle

1024 个赞

需要登录后方可回复, 如果你还没有账号请注册新账号

相关文章

HTML5 虚拟键盘出现挡住输入框的解决办法

Saadiya 2020-08-08

873

HTML5里的placeholder属性使用实例和美化显示效果的方法

Talia 2021-04-07

716

利用kernel提供的接口打印进程号(pid)

Cynthia 2020-09-01

568

教你两步解决conda安装pytorch时下载速度慢or超时的问题

Gamila 2023-03-31

351

Linux下PyTorch安装教程

Karima 2023-03-31

1255

Pytorch中的图像增广transforms类和预处理方法

Dara 2023-04-02

1178

图文详解如何利用PyTorch实现图像识别

Yelena 2023-04-06

918

Pytorch中的model.train() 和 model.eval() 原理与用法解析

Gitana 2023-04-14

1817

分布式训练training-operator和pytorch-distributed RANK变量不统一解决

Pandora 2023-04-14

1631

基于Pytorch实现分类器的示例详解

Viveka 2023-04-18

1798

详解利用Pytorch实现ResNet网络

Tia 2023-04-20

1496

PyTorch定义Tensor及索引和切片(最新推荐)

Kara 2023-04-22

750

python windows安装cuda+cudnn+pytorch教程

Fawn 2023-05-12

646

numpy中的随机打乱数据方法np.random.shuffle解读

Jayne 2023-05-13

1849

pytorch版本PSEnet训练并部署方式

Adelaide 2023-05-13

471

PyTorch模型转换为ONNX格式实现过程详解

Tani 2023-05-27

556

利用Pytorch实现ResNet网络构建及模型训练

Tanisha 2023-05-27

1264

Pytorch实现ResNet网络之ResidualBlock残差块

Kande 2023-05-27

1208

PyTorch常用函数torch.cat()中dim参数使用说明

Tricia 2023-05-27

372

Pytorch基础教程之torchserve模型部署解析

Xylona 2023-07-20

1007

我要提问

致谢

帮助他人，成就自己。

人生最大成功就是伸出热情而温暖的双手，尽自己所能去帮助身边的每一个人，只要无私的奉献，就会收获到美好的生活。

1024问感谢每一位朋友的帮助和支持。

软件开发网提供编程的基础软件技术培训教程,软件开发编程实例讲解Go,Node,HTML,CSS,Javascript,Python,Java,Ruby,C,PHP,MySQL等软件开发编程语言以及数据开发的基础知识，也提供大量的软件开发在线实例、从入门到精通就在1024问。

育儿网微养生全球行美食街育儿菜谱大全海南旅游女性养狗百科星座