pytorch实现花朵数据集读取

import os

from PIL import Image

from torch.utils import data

import numpy as np

from torchvision import transforms as T

class My_Data(data.Dataset):

    def __init__(self, root, transforms=None, train=True, test=False):

        '''

        目标：获取所有图片路径，并根据训练、验证、测试划分数据

        '''

        self.test = test

        classs = os.listdir(root)

        imgs = []

        labels = []

        for idx, folder in enumerate(classs):

            cate = os.path.join(root, folder)

            for img_num, im in enumerate(os.listdir(cate)):

                img_path = os.path.join(cate, im)

                #打包图片路径（转换为list）

                imgs.append(img_path)

                #打包标签路径（转换为list）

                labels.append(idx)

        if self.test:

            imgs = sorted(imgs, key=lambda x: int(x.split('.')[-2].split('/')[-1]))

        else:

            imgs = list(zip(imgs , labels))

            #将图片路径与标签打包成一个list

        imgs_num = len(imgs)

        # shuffle imgs

        np.random.seed(100)

        imgs = np.random.permutation(imgs)

        # 划分训练、验证集，验证:训练 = 3:7

        if self.test:

            self.imgs = imgs

        elif train:

            self.imgs = imgs[:int(0.7 * imgs_num)]

        else:

            self.imgs = imgs[int(0.7 * imgs_num):]

        if transforms is None:

            # 数据转换操作，测试验证和训练的数据转换有所区别

            normalize = T.Normalize(mean=[0.485, 0.456, 0.406],

                                    std=[0.229, 0.224, 0.225])

            # 测试集和验证集不用数据增强

            if self.test or not train:

                self.transforms = T.Compose([

                    T.Resize(32),

                    T.CenterCrop(32),

                    T.ToTensor(),

                    normalize

                ])

                # 训练集需要数据增强

            else:

                self.transforms = T.Compose([

                    T.Resize(32),

                    T.RandomResizedCrop(32),

                    T.RandomHorizontalFlip(),

                    T.ToTensor(),

                    normalize

                ])

    def __getitem__(self,index):

        '''

        返回一张图片的数据

        对于测试集，没有label，返回图片id，如1000.jpg返回1000

        送入一个batch_size的数据

        '''

        img_lables = self.imgs[index]

        img_path = img_lables[0]

        if self.test:

            label = int(self.imgs[index].split('.')[-2].split('/')[-1])

        else:

            label = int(img_lables[1])

        data = Image.open(img_path)

        data = self.transforms(data)

        return data, label

    def __len__(self):

        '''

        返回数据集中所有图片的个数

        '''

        return len(self.imgs)

作为备份使用。

pytorch实现花朵数据集读取的更多相关文章

Pytorch数据集读取
Pytorch中数据集读取在机器学习中,有很多形式的数据,我们就以最常用的几种来看: 在Pytorch中,他自带了很多数据集,比如MNIST.CIFAR10等,这些自带的数据集获得和读取十分简便: ...
基于深度学习和迁移学习的识花实践——利用 VGG16 的深度网络结构中的五轮卷积网络层和池化层，对每张图片得到一个 4096 维的特征向量，然后我们直接用这个特征向量替代原来的图片，再加若干层全连接的神经网络，对花朵数据集进行训练（属于模型迁移）
基于深度学习和迁移学习的识花实践(转) 深度学习是人工智能领域近年来最火热的话题之一,但是对于个人来说,以往想要玩转深度学习除了要具备高超的编程技巧,还需要有海量的数据和强劲的硬件.不过 Tens ...
[Pytorch]PyTorch Dataloader自定义数据读取
整理一下看到的自定义数据读取的方法,较好的有一下三篇文章, 其实自定义的方法就是把现有数据集的train和test分别用含有图像路径与label的list返回就好了,所以需要根据数据集随机应变. 所 ...
pytorch 加载数据集
pytorch初学者,想加载自己的数据,了解了一下数据类型.维度等信息,方便以后加载其他数据. 1 torchvision.transforms实现数据预处理 transforms.Totensor( ...
【小白学PyTorch】16 TF2读取图片的方法
[新闻]:机器学习炼丹术的粉丝的人工智能交流群已经建立,目前有目标检测.医学图像.NLP等多个学术交流分群和水群唠嗑的总群,欢迎大家加炼丹兄为好友,加入炼丹协会.微信:cyx645016617. 参考 ...
CIFAR-10数据集读取
参考:https://jingyan.baidu.com/article/656db9183296c7e381249cf4.html 1.使用读取方式pickle def unpickle(file) ...
什么是pytorch（4.数据集加载和处理）(翻译)
数据集加载和处理这里主要涉及两个包:torchvision.datasets 和torch.utils.data.Dataset 和DataLoader torchvision.datasets是一 ...
深度学习（tensorflow） —— 自己数据集读取opencv
先来看一下我们的目录: dataset1 和creat_dataset.py 属于同一目录 mergeImg1 和mergeImg2 为Dataset1的两子目录(两类为例子)目录中存储图像等文件核 ...
pytorch 计算图像数据集的均值和标准差
在使用 torchvision.transforms进行数据处理时我们经常进行的操作是: transforms.Normalize((0.485,0.456,0.406), (0.229,0.224, ...

随机推荐

多线程之间的通信（等待唤醒机制、Lock 及其它线程的方法）
一.多线程之间的通信. 就是多个线程在操作同一份数据, 但是操作的方法不同. 如: 对于同一个存储块,其中有两个存储位:name sex, 现有两个线程,一个向其中存放数据,一个打印其中的数据. ...
Makefile ------ $@ $^ %< 使用
一步一步理解 1.源程序的编译在Linux下面,如果要编译一个C语言源程序,我们要使用GNU的gcc编译器. 下面我们以一个实例来说明如何使用gcc编译器. 假设我们有下面一个非常简单的源程序(he ...
XMind 入门教程
选自:http://www.xmindchina.net/ XMind 是一款非常实用的商业思维导图软件,应用全球最先进的Eclipse RCP 软件架构,全力打造易用.高效的可视化思维软件.对于新手 ...
jsp中的request.getContextPath()
jsp中的request.getContextPath() <%=request.getContextPath()%>是为了解决相对路径的问题,可返回站点的根路径. 但不用也可以吧,比 ...
聊一聊docker存储驱动
目录镜像的分层特性容器读写层的工作原理写时复制用时配置 Docker存储驱动 AUFS OverlayFS Devicemapper 常用存储驱动对比 AUFS VS OverlayFS Ov ...
Java_JDBC一般写法
JDBC是Java DataBase Connectivity,Java程序访问数据库的标准接口. 如果是maven工程先加入依赖的jar包: <dependency> <group ...
Python基础【day01】：初始模块（五）
本节内容 1.标准库 1.sys 2.os 2.第三方库 1.for mac 2.for linux Python的强大之处在于他有非常丰富和强大的标准库和第三方库,几乎你想实现的任何功能都有相应的P ...
MVC中常用的跳转方法
MVC中常用的跳转方法这里总结了几种MVC中的跳转方式,主要汇总了前端页面跳转,后台的跳转,和过滤器中的跳转方式. 1.在前端页面的跳转方式  <a hre ...
数据库sql语句例题（转）
SQL数据库面试题以及答案(50例题) Student(S#,Sname,Sage,Ssex)学生表 S#:学号 Sname:学生姓名 Sage:学生年龄 Ssex:学生性别 Course(C#,Cn ...
bzoj千题计划302：bzoj3160: 万径人踪灭
https://www.lydsy.com/JudgeOnline/problem.php?id=3160 不连续的回文串数量=所有的回文序列数量-连续的回文子串连续的回文子串: manacher ...

pytorch实现花朵数据集读取

pytorch实现花朵数据集读取的更多相关文章

随机推荐

热门专题