[Pytorch]Pytorch 保存模型与加载模型(转)

转自：知乎

保存模型与加载模型
冻结一部分参数，训练另一部分参数
采用不同的学习率进行训练

1.保存模型与加载

简单的保存与加载方法：

# 保存整个网络

torch.save(net, PATH)

# 保存网络中的参数, 速度快，占空间少

torch.save(net.state_dict(),PATH)

#--------------------------------------------------

#针对上面一般的保存方法，加载的方法分别是：

model_dict=torch.load(PATH)

model_dict=model.load_state_dict(torch.load(PATH))

然而，在实验中往往需要保存更多的信息，比如优化器的参数，那么可以采取下面的方法保存：

torch.save({'epoch': epochID + 1, 'state_dict': model.state_dict(), 'best_loss': lossMIN,

                            'optimizer': optimizer.state_dict(),'alpha': loss.alpha, 'gamma': loss.gamma},

                           checkpoint_path + '/m-' + launchTimestamp + '-' + str("%.4f" % lossMIN) + '.pth.tar')

以上包含的信息有，epochID, state_dict, min loss, optimizer, 自定义损失函数的两个参数；格式以字典的格式存储。

加载的方式：

def load_checkpoint(model, checkpoint_PATH, optimizer):

    if checkpoint != None:

        model_CKPT = torch.load(checkpoint_PATH)

        model.load_state_dict(model_CKPT['state_dict'])

        print('loading checkpoint!')

        optimizer.load_state_dict(model_CKPT['optimizer'])

    return model, optimizer

其他的参数可以通过以字典的方式获得

但是，但是，我们可能修改了一部分网络，比如加了一些，删除一些，等等，那么需要过滤这些参数，加载方式：

def load_checkpoint(model, checkpoint, optimizer, loadOptimizer):

    if checkpoint != 'No':

        print("loading checkpoint...")

        model_dict = model.state_dict()

        modelCheckpoint = torch.load(checkpoint)

        pretrained_dict = modelCheckpoint['state_dict']

        # 过滤操作

        new_dict = {k: v for k, v in pretrained_dict.items() if k in model_dict.keys()}

        model_dict.update(new_dict)

        # 打印出来，更新了多少的参数

        print('Total : {}, update: {}'.format(len(pretrained_dict), len(new_dict)))

        model.load_state_dict(model_dict)

        print("loaded finished!")

        # 如果不需要更新优化器那么设置为false

        if loadOptimizer == True:

            optimizer.load_state_dict(modelCheckpoint['optimizer'])

            print('loaded! optimizer')

        else:

            print('not loaded optimizer')

    else:

        print('No checkpoint is included')

    return model, optimizer

2.冻结部分参数，训练另一部分参数

1）添加下面一句话到模型中

for p in self.parameters():

    p.requires_grad = False

比如加载了resnet预训练模型之后，在resenet的基础上连接了新的模快，resenet模块那部分可以先暂时冻结不更新，只更新其他部分的参数，那么可以在下面加入上面那句话

class RESNET_MF(nn.Module):

    def __init__(self, model, pretrained):

        super(RESNET_MF, self).__init__()

        self.resnet = model(pretrained)

        for p in self.parameters():

            p.requires_grad = False

        self.f = SpectralNorm(nn.Conv2d(2048, 512, 1))

        self.g = SpectralNorm(nn.Conv2d(2048, 512, 1))

        self.h = SpectralNorm(nn.Conv2d(2048, 2048, 1))

        ...

同时在优化器中添加：filter(lambda p: p.requires_grad, model.parameters())

optimizer = optim.Adam(filter(lambda p: p.requires_grad, model.parameters()), lr=0.001, betas=(0.9, 0.999),

                               eps=1e-08, weight_decay=1e-5)

2) 参数保存在有序的字典中，那么可以通过查找参数的名字对应的id值，进行冻结

查找的代码：

    model_dict = torch.load('net.pth.tar').state_dict()

    dict_name = list(model_dict)

    for i, p in enumerate(dict_name):

        print(i, p)

保存一下这个文件，可以看到大致是这个样子的：

0 gamma

1 resnet.conv1.weight

2 resnet.bn1.weight

3 resnet.bn1.bias

4 resnet.bn1.running_mean

5 resnet.bn1.running_var

6 resnet.layer1.0.conv1.weight

7 resnet.layer1.0.bn1.weight

8 resnet.layer1.0.bn1.bias

9 resnet.layer1.0.bn1.running_mean

....

同样在模型中添加这样的代码：

for i,p in enumerate(net.parameters()):

    if i < 165:

        p.requires_grad = False

在优化器中添加上面的那句话可以实现参数的屏蔽

[Pytorch]Pytorch 保存模型与加载模型(转)的更多相关文章

PyTorch保存模型与加载模型+Finetune预训练模型使用
Pytorch 保存模型与加载模型 PyTorch之保存加载模型参数初始化参数的初始化其实就是对参数赋值.而我们需要学习的参数其实都是Variable,它其实是对Tensor的封装,同时提供了da ...
【4】TensorFlow光速入门-保存模型及加载模型并使用
本文地址:https://www.cnblogs.com/tujia/p/13862360.html 系列文章: [0]TensorFlow光速入门-序 [1]TensorFlow光速入门-tenso ...
莫烦python教程学习笔记——保存模型、加载模型的两种方法
# View more python tutorials on my Youtube and Youku channel!!! # Youtube video tutorial: https://ww ...
深度学习原理与框架-猫狗图像识别-卷积神经网络(代码) 1.cv2.resize(图片压缩) 2..get_shape()[1:4].num_elements(获得最后三维度之和) 3.saver.save(训练参数的保存) 4.tf.train.import_meta_graph(加载模型结构) 5.saver.restore(训练参数载入)
1.cv2.resize(image, (image_size, image_size), 0, 0, cv2.INTER_LINEAR) 参数说明:image表示输入图片,image_size表示变 ...
keras模型的保存与重新加载
# 模型保存JSON文件 model_json = model.to_json() with open('model.json', 'w') as file: file.write(model_jso ...
TensorFlow保存、加载模型参数 | 原理描述及踩坑经验总结
写在前面我之前使用的LSTM计算单元是根据其前向传播的计算公式手动实现的,这两天想要和TensorFlow自带的tf.nn.rnn_cell.BasicLSTMCell()比较一下,看看哪个训练速度 ...
MindSpore保存与加载模型
技术背景近几年在机器学习和传统搜索算法的结合中,逐渐发展出了一种Search To Optimization的思维,旨在通过构造一个特定的机器学习模型,来替代传统算法中的搜索过程,进而加速经典图论等 ...
NeHe OpenGL教程第三十一课：加载模型
转自[翻译]NeHe OpenGL 教程前言声明,此 NeHe OpenGL教程系列文章由51博客yarin翻译(2010-08-19),本博客为转载并稍加整理与修改.对NeHe的OpenGL管线 ...
学习笔记TF049:TensorFlow 模型存储加载、队列线程、加载数据、自定义操作
生成检查点文件(chekpoint file),扩展名.ckpt,tf.train.Saver对象调用Saver.save()生成.包含权重和其他程序定义变量,不包含图结构.另一程序使用,需要重新创建 ...

随机推荐

Linux下安装谷歌访问助手，解压缩时出现中文乱码
1.sudo apt-get install unar 安装unar 2.unar 谷歌访问助手chrome版本.zip 注意:使用 lsar 命令可以查看压缩文件内有那些文件: 例:lsar 谷 ...
转：Java多线程学习（吐血超详细总结）
版权声明:本文为博主林炳文Evankaka原创文章,转载请注明出处http://blog.csdn.net/evankaka 目录(?)[+] 林炳文Evankaka原创作品.转载请注明出处http: ...
CMDB实现的四种方式
第一种(agent): 这种方式是通过向每一台服务器安装agent脚本,然后通过中控机的API,来收集所需要的数据,最后放到数据库中,在通过web的方式显示出来. 实现流程图: 1.录入资产(主机名, ...
CanvasRenderingContext2D.lineDashOffset
https://developer.mozilla.org/zh-CN/docs/Web/API/CanvasRenderingContext2D/lineDashOffset CanvasRende ...
python - 常用模块 os, sys
常用模块: os(处理文件和目录), sys(sys 模块包含了与 Python 解释器和它的环境有关的函数.) sys.argv 变量是一个字符串的列表.特别地,sys.argv 包含了命令行参 ...
vue生命周期探究（二）
vue生命周期探究(二) 转载自:https://segmentfault.com/a/1190000008923105 上一章我们介绍了vue的组件生命周期和路由勾子,这一章,让我们来看看在vue- ...
DevStore分享：详析消费者十大心理学
做生意,其实就是一个恋爱的过程,让用户找到你.了解你,爱上你.而这个过程中的关键点就是用户.只要与用户心理相关的,那么就会影响到他们的购买决策.而作为卖方的你,就应该了解消费者心里面在想些什么. 第一 ...
PHP Web木马扫描器
<?php header('content-type:text/html;charset=gbk'); set_time_limit(0);//防止超时 /** * * php目录扫描监控 ...
AtCoder Regular Contest 080　E - Young Maids
地址:http://arc080.contest.atcoder.jp/tasks/arc080_c 题目: E - Young Maids Time limit : 2sec / Memory li ...
Codeforces Round #408 (Div. 2) D - Police Stations
地址:http://codeforces.com/contest/796/problem/D 题目: D. Police Stations time limit per test 2 seconds ...

[Pytorch]Pytorch 保存模型与加载模型(转)

1.保存模型与加载

2.冻结部分参数，训练另一部分参数

[Pytorch]Pytorch 保存模型与加载模型(转)的更多相关文章

随机推荐

热门专题