19赞

pytorch下大型数据集(大型图片)的导入方式

作者：贴进你的心聆听你的世界 | 2022-01-26 04:38

今天小编就为大家分享一篇pytorch下大型数据集(大型图片)的导入方式，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧

使用torch.utils.data.Dataset类处理图片数据时，

1. 我们需要定义三个基本的函数，以下是基本流程

class our_datasets(Data.Dataset):
 
  def __init__(self,root,is_resize=False,is_transfrom=False):
    #这里只是个参考。按自己需求写。
    self.root=root
    self.is_resize=is_resize
    self.is_transfrom=is_transfrom
 
    self.imgs_list=...#这里建议保存的是 图片的路径 而不是 图片的数据
    self.labs_list=...
 
  def __getitem__(self, index):
 
    img_path,lab=self.imgs_list[index],self.labs_list[index]
    
    #这里使用PIL库读取图片数据.
    img_data = Image.open(img_path).convert('RGB')
 
    #这里看自己需要，可以不要
    if self.is_resize:
      img_data = img_data.resize((self.is_resize[0], self.is_resize[1]), Image.ANTIALIAS)
    
    #但是数据转换建议加上，很多时候都会用到
    if self.is_transfrom:
      img_data=self.is_transfrom(img_data)
    return img_data,lab
 
  def __len__(self):
 
    return len(self.imgs_list)

这里，我将读取图片的步骤放到 __getitem__ ，是因为这样放的话，对内存的要求会降低很多，我们只是将数据的路径导入了内存中，当需要读取这个图片数据时，再读取，这样更像是随用随取。如果将这部分放到 __init__ 里面，会一次将图片数据都加载到内存中，如果数据量太大，会直接卡死。

2.Dataset 类返回的数据类型是与你读取时的类型一致的。但是在 pytorch使用时，会提示

TypeError: batch must contain tensors, numbers, dicts or lists; found

通常，在数据了不大时，我一般都是在读取数据后加一句，转换成 numpy.array类型。

但是，在处理较大型的数据时，这样会很慢。

这时候，我建议直接使用 torchvision来进行数据转换。

is_transfrom=torchvision.transforms.ToTensor()

将上例代码加入 Dataset类中，这样就会快很多。

以上这篇pytorch下大型数据集(大型图片)的导入方式就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持。

推荐阅读

程序员
基于UIlabel行计数扩展tableviewcell

如何解决《基于UIlabel行计数扩展tableviewcell》经验，为你挑选了1个好方法。 ... [详细]
程序员
使用Eclipse时,Maven编译失败并显示"找不到符号",它编译

如何解决《使用Eclipse时,Maven编译失败并显示"找不到符号",它编译》经验，为你挑选了0个好方法。 ... [详细]
程序员
数组初始化需要括号括起的初始化列表lambda

如何解决《数组初始化需要括号括起的初始化列表lambda》经验，为你挑选了1个好方法。 ... [详细]
程序员
Firefox:"此页面的某些部分不安全,例如图片." 什么算不安全？

如何解决《Firefox:"此页面的某些部分不安全,例如图片."什么算不安全？》经验，为你挑选了2个好方法。 ... [详细]
程序员
使用Chart.js设计条形图和线条

如何解决《使用Chart.js设计条形图和线条》经验，为你挑选了2个好方法。 ... [详细]
程序员
ASP.NET成员资格HashAlgorithmType默认为HMACSHA256,密码哈希键是否也是如此？

如何解决《ASP.NET成员资格HashAlgorithmType默认为HMACSHA256,密码哈希键是否也是如此？》经验，为你挑选了1个好方法。 ... [详细]
程序员
TSQL中的日期比较

如何解决《TSQL中的日期比较》经验，为你挑选了1个好方法。 ... [详细]
程序员
Android RecyclerView StaggeredGrid项在滚动顶部时更改位置

如何解决《AndroidRecyclerViewStaggeredGrid项在滚动顶部时更改位置》经验，为你挑选了1个好方法。 ... [详细]
程序员
使用python/django进行日期时间本地化

如何解决《使用python/django进行日期时间本地化》经验，为你挑选了0个好方法。 ... [详细]
程序员
newScheduledThreadPool（）方法的参数“ corePoolSize”是什么意思？

如何解决《newScheduledThreadPool（）方法的参数“corePoolSize”是什么意思？》经验，为你挑选了1个好方法。 ... [详细]
程序员
在PHP 7中键入提示 - 对象数组

如何解决《在PHP7中键入提示-对象数组》经验，为你挑选了3个好方法。 ... [详细]
程序员
为什么此导航栏上方有空格

如何解决《为什么此导航栏上方有空格》经验，为你挑选了2个好方法。 ... [详细]
程序员
是否可能在一个反应组件中有两个状态

如何解决《是否可能在一个反应组件中有两个状态》经验，为你挑选了0个好方法。 ... [详细]
程序员
如何在R包传单中添加比例尺？

如何解决《如何在R包传单中添加比例尺？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Plivo红宝石宝石类冲突

如何解决《Plivo红宝石宝石类冲突》经验，为你挑选了1个好方法。 ... [详细]
程序员
比较C#对象

如何解决《比较C#对象》经验，为你挑选了1个好方法。 ... [详细]
程序员
简单的ASP经典程序不起作用

如何解决《简单的ASP经典程序不起作用》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何检查字典中是否存在键值对？

如何解决《如何检查字典中是否存在键值对？》经验，为你挑选了2个好方法。 ... [详细]
程序员
将值传递给路由

如何解决《将值传递给路由》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何从AppVeyor发布beta nuget包

如何解决《如何从AppVeyor发布betanuget包》经验，为你挑选了1个好方法。 ... [详细]

贴进你的心聆听你的世界

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章