Pytorch迁移学习

环境：

Pytorch1.1，Python3.6，win10/ubuntu18，GPU

正文

Pytorch构建ResNet18模型并训练，进行真实图片分类；
利用预训练的ResNet18模型进行Fine tune，直接进行图片分类；站在巨人的肩膀上，使用已经在ImageNet上训练好的模型，除了最后一层全连接层，中间层的参数全部迁移到目标模型上，如下图所示

项目结构如下所示

pokemon里面存放数据，分别是五个文件夹，其中每个文件夹分别存放一定数量的图片，总共1000多张图片；

best.mdl是保存下来的模型，可以直接加载进行分类

resnet.py是自己搭建的ResNet18模型

train_scratch.py利用resnet.py中的ResNet18模型进行图片分类

train_transfer.py利用下载的ResNet18模型进行图片分类

接下来进入正题：

pokemon.py：

import  torch

import  os, glob

import  random, csv

from    torch.utils.data import Dataset, DataLoader

from    torchvision import transforms

from    PIL import Image

class Pokemon(Dataset):

    def __init__(self, root, resize, mode):

        super(Pokemon, self).__init__()

        self.root = root

        self.resize = resize

        self.name2label = {} # "sq...":0

        for name in sorted(os.listdir(os.path.join(root))):

            if not os.path.isdir(os.path.join(root, name)):

                continue

            self.name2label[name] = len(self.name2label.keys())

        # print(self.name2label)

        # image, label

        self.images, self.labels = self.load_csv('images.csv')

        if mode=='train': # 60%

            self.images = self.images[:int(0.6*len(self.images))]

            self.labels = self.labels[:int(0.6*len(self.labels))]

        elif mode=='val': # 20% = 60%->80%

            self.images = self.images[int(0.6*len(self.images)):int(0.8*len(self.images))]

            self.labels = self.labels[int(0.6*len(self.labels)):int(0.8*len(self.labels))]

        else: # 20% = 80%->100%

            self.images = self.images[int(0.8*len(self.images)):]

            self.labels = self.labels[int(0.8*len(self.labels)):]

    def load_csv(self, filename):

        if not os.path.exists(os.path.join(self.root, filename)):

            images = []

            for name in self.name2label.keys():

                # 'pokemon\\mewtwo\\00001.png

                images += glob.glob(os.path.join(self.root, name, '*.png'))

                images += glob.glob(os.path.join(self.root, name, '*.jpg'))

                images += glob.glob(os.path.join(self.root, name, '*.jpeg'))

            # 1167, 'pokemon\\bulbasaur\\00000000.png'

            print(len(images), images)

            random.shuffle(images)

            with open(os.path.join(self.root, filename), mode='w', newline='') as f:

                writer = csv.writer(f)

                for img in images: # 'pokemon\\bulbasaur\\00000000.png'

                    name = img.split(os.sep)[-2]

                    label = self.name2label[name]

                    # 'pokemon\\bulbasaur\\00000000.png', 0

                    writer.writerow([img, label])

                print('writen into csv file:', filename)

        # read from csv file

        images, labels = [], []

        with open(os.path.join(self.root, filename)) as f:

            reader = csv.reader(f)

            for row in reader:

                # 'pokemon\\bulbasaur\\00000000.png', 0

                img, label = row

                label = int(label)

                images.append(img)

                labels.append(label)

        assert len(images) == len(labels)

        return images, labels

    def __len__(self):

        return len(self.images)

    def denormalize(self, x_hat):

        mean = [0.485, 0.456, 0.406]

        std = [0.229, 0.224, 0.225]

        # x_hat = (x-mean)/std

        # x = x_hat*std = mean

        # x: [c, h, w]

        # mean: [3] => [3, 1, 1]

        mean = torch.tensor(mean).unsqueeze(1).unsqueeze(1)

        std = torch.tensor(std).unsqueeze(1).unsqueeze(1)

        # print(mean.shape, std.shape)

        x = x_hat * std + mean

        return x

    def __getitem__(self, idx):

        # idx~[0~len(images)]

        # self.images, self.labels

        # img: 'pokemon\\bulbasaur\\00000000.png'

        # label: 0

        img, label = self.images[idx], self.labels[idx]

        tf = transforms.Compose([

            lambda x:Image.open(x).convert('RGB'), # string path= > image data

            transforms.Resize((int(self.resize*1.25), int(self.resize*1.25))),

            transforms.RandomRotation(15),

            transforms.CenterCrop(self.resize),

            transforms.ToTensor(),

            transforms.Normalize(mean=[0.485, 0.456, 0.406],

                                 std=[0.229, 0.224, 0.225])

        ])

        img = tf(img)

        label = torch.tensor(label)

        return img, label

def main():

    import  visdom

    import  time

    import  torchvision

    viz = visdom.Visdom()

    # tf = transforms.Compose([

    #                 transforms.Resize((64,64)),

    #                 transforms.ToTensor(),

    # ])

    # db = torchvision.datasets.ImageFolder(root='pokemon', transform=tf)

    # loader = DataLoader(db, batch_size=32, shuffle=True)

    #

    # print(db.class_to_idx)

    #

    # for x,y in loader:

    #     viz.images(x, nrow=8, win='batch', opts=dict(title='batch'))

    #     viz.text(str(y.numpy()), win='label', opts=dict(title='batch-y'))

    #

    #     time.sleep(10)

    db = Pokemon('pokemon', 224, 'train')

    x,y = next(iter(db))

    print('sample:', x.shape, y.shape, y)

    viz.image(db.denormalize(x), win='sample_x', opts=dict(title='sample_x'))

    loader = DataLoader(db, batch_size=32, shuffle=True, num_workers=8)

    for x,y in loader:

        viz.images(db.denormalize(x), nrow=8, win='batch', opts=dict(title='batch'))

        viz.text(str(y.numpy()), win='label', opts=dict(title='batch-y'))

        time.sleep(10)

if __name__ == '__main__':

    main()

注释：Pokemon类功能是对数据集进行解析，把文件夹中的图片分成train,val,test三个集合

Pytorch迁移学习的更多相关文章

Pytorch迁移学习实现驾驶场景分类
Pytorch迁移学习实现驾驶场景分类源代码:https://github.com/Dalaska/scene_clf 1.安装 pytorch 直接用官网上的方法能装上但下载很慢.通过换源安装发现 ...
PyTorch迁移学习-私人数据集上的蚂蚁蜜蜂分类
迁移学习的两个主要场景微调CNN:使用预训练的网络来初始化自己的网络,而不是随机初始化,然后训练即可将CNN看成固定的特征提取器:固定前面的层,重写最后的全连接层,只有这个新的层会被训练下面修改 ...
pytorch 迁移学习[摘自官网]
迁移学习包含两种:微调和特征提取器. 微调:对整个网络进行训练,更新所有参数特征提取器:只对最后的输出层训练,其他层的权重保持不变当然,二者的共性就是需要加载训练好的权重,比如在ImageNet上 ...
修改pytorch官方实例适用于自己的二分类迁移学习项目
本demo从pytorch官方的迁移学习示例修改而来,增加了以下功能: 根据AUC来迭代最优参数: 五折交叉验证: 输出验证集错误分类图片: 输出分类报告并保存AUC结果图片. import os i ...
PyTorch基础——迁移学习
一.介绍内容使机器能够"举一反三"的能力知识点使用 PyTorch 的数据集套件从本地加载数据的方法迁移训练好的大型神经网络模型到自己模型中的方法迁移学习与普通深度学习 ...
使用PyTorch进行迁移学习
概述迁移学习可以改变你建立机器学习和深度学习模型的方式了解如何使用PyTorch进行迁移学习,以及如何将其与使用预训练的模型联系起来我们将使用真实世界的数据集,并比较使用卷积神经网络(CNNs) ...
PyTorch专栏（五）：迁移学习
专栏目录: 第一章:PyTorch之简介与下载 PyTorch简介 PyTorch环境搭建第二章:PyTorch之60分钟入门 PyTorch入门 PyTorch自动微分 PyTorch神经网络 P ...
pytorch 测试迁移学习
训练源码: 源码仓库:https://github.com/pytorch/tutorials 迁移学习测试代码:tutorials/beginner_source/transfer_learning ...
[PyTorch入门]之迁移学习
迁移学习教程来自这里. 在本教程中,你将学习如何使用迁移学习来训练你的网络.在cs231n notes你可以了解更多关于迁移学习的知识. 在实践中,很少有人从头开始训练整个卷积网络(使用随机初始化) ...

随机推荐

python打开文件的方式
r 以只读模式打开文件 w 以只写模式打开文件,文件若存在,首先要清空,然后(重新创建) a 以追加模式打开(从EOF开始,必要时创建新文件),把所有要写入文件的数据追加到文件的末尾,即使使 ...
CSS中的 vh/vw
vh 相对于当前窗口的大小,我用electron-vue来开发一个桌面应该,就用到这个,很方便,百分比需要外面有一个固定的高度,依赖父元素
Python 运算符Ⅳ
Python比较运算符以下假设变量a为10,变量b为20: 以下实例演示了Python所有http://www.xuanhe.net/比较运算符的操作: 以上实例输出结果: Python赋值运算符 ...
mysql-5.6.45-linux-glibc2.12-x86_64.tar.gz下载安装
一 ,mysql下载需要注册,可以通过组合url越过注册下载需要的包. 下载地址: https://dev.mysql.com/get/Downloads/MySQL-5.6/mysql-5.6.3 ...
PHP 字符串相关常识
0x00 前言第一次遇见字符串这个概念是在学 C 语言的时候,那时候觉得字符串也没有什么难的,不就是一个以 \0 结尾的 char 数组而已咯.后来在学习 PHP 的过程中也同样保持这个观念,不过在 ...
BZOJ 4883: [Lydsy1705月赛]棋盘上的守卫最小生成树 + 建模
Description 在一个n*m的棋盘上要放置若干个守卫.对于n行来说,每行必须恰好放置一个横向守卫:同理对于m列来说,每列必须恰好放置一个纵向守卫.每个位置放置守卫的代价是不一样的,且每个位置 ...
Python3学习笔记（七）：字典
在python中,有一种通过名字来引用值的数据结构,这种类型的数据结构成为映射. 字典是Python中唯一内建的映射类型,具有以下特点: 字典中的值是无序的值存在特定的键(key)下键(key)可 ...
Ubuntu 16.04修改ssh端口
1 安装防火墙 sudo apt-get install ufw启用 sudo ufw enable sudo ufw default deny 作用:开启了防火墙并随系统启动同时关闭所有外部对本机的 ...
采用.bat批处理命令快速设置Java环境变量
背景: java课程培训,每次到机房需要重新安装JDK,每次都采用图形界面进行操作比较麻烦(慢),于是在网上查了一下CMD命令设置系统环境变量的方法,再次记录下来. 设置方法: 1.找到JDK安装路径 ...
[BZOJ2839]:集合计数（组合数学+容斥）
题目传送门题目描述 .(是质数喔~) 输入格式一行两个整数N,K. 输出格式一行为答案. 样例样例输入: 3 2 样例输出: 样例说明假设原集合为{A,B,C} 则满足条件的方案为:{AB, ...

Pytorch迁移学习

环境：

正文

Pytorch迁移学习的更多相关文章

随机推荐

热门专题