这篇博客来自csdn，完全用于学习。

Introduce

在pytorch中，torch.nn.Module模块中的state_dict变量存放训练过程中需要学习的权重和偏执系数，state_dict作为python的字典对象将每一层的参数映射成tensor张量，需要注意的是torch.nn.Module模块中的state_dict只包含卷积层和全连接层的参数，当网络中存在batchnorm时，例如vgg网络结构，torch.nn.Module模块中的state_dict也会存放batchnorm's running_mean，关于batchnorm详解可见https://blog.csdn.net/wzy_zju/article/details/81262453

torch.optim模块中的Optimizer优化器对象也存在一个state_dict对象，此处的state_dict字典对象包含state和param_groups的字典对象，而param_groups key对应的value也是一个由学习率，动量等参数组成的一个字典对象。

因为state_dict本质上Python字典对象，所以可以很好地进行保存、更新、修改和恢复操作（python字典结构的特性），从而为PyTorch模型和优化器增加了大量的模块化。

Sample

通过一个简单的案例来输出state_dict字典对象中存放的变量

#encoding:utf-8

import torch

import torch.nn as nn

import torch.optim as optim

import torchvision

import numpy as mp

import matplotlib.pyplot as plt

import torch.nn.functional as F

#define model

class TheModelClass(nn.Module):

    def __init__(self):

        super(TheModelClass,self).__init__()

        self.conv1=nn.Conv2d(3,6,5)

        self.pool=nn.MaxPool2d(2,2)

        self.conv2=nn.Conv2d(6,16,5)

        self.fc1=nn.Linear(16*5*5,120)

        self.fc2=nn.Linear(120,84)

        self.fc3=nn.Linear(84,10)

    def forward(self,x):

        x=self.pool(F.relu(self.conv1(x)))

        x=self.pool(F.relu(self.conv2(x)))

        x=x.view(-1,16*5*5)

        x=F.relu(self.fc1(x))

        x=F.relu(self.fc2(x))

        x=self.fc3(x)

        return x

def main():

    # Initialize model

    model = TheModelClass()

    #Initialize optimizer

    optimizer=optim.SGD(model.parameters(),lr=0.001,momentum=0.9)

    #print model's state_dict

    print('Model.state_dict:')

    for param_tensor in model.state_dict():

        #打印 key value字典

        print(param_tensor,'\t',model.state_dict()[param_tensor].size())

    #print optimizer's state_dict

    print('Optimizer,s state_dict:')

    for var_name in optimizer.state_dict():

        print(var_name,'\t',optimizer.state_dict()[var_name])

if __name__=='__main__':

    main()

output：

Model.state_dict:

conv1.weight      torch.Size([6, 3, 5, 5])

conv1.bias      torch.Size([6])

conv2.weight      torch.Size([16, 6, 5, 5])

conv2.bias      torch.Size([16])

fc1.weight      torch.Size([120, 400])

fc1.bias      torch.Size([120])

fc2.weight      torch.Size([84, 120])

fc2.bias      torch.Size([84])

fc3.weight      torch.Size([10, 84])

fc3.bias      torch.Size([10])

Optimizer,s state_dict:

state      {}

param_groups      [{'lr': 0.001, 'momentum': 0.9, 'dampening': 0, 'weight_decay': 0, 'nesterov': False, 'params': [0, 1, 2, 3, 4, 5, 6, 7, 8, 9]}]

csdn

CSDN

csdn

CSDN

【PyTorch】state_dict详解的更多相关文章

Pytorch框架详解之一
Pytorch基础操作 numpy基础操作定义数组(一维与多维) 寻找最大值维度上升与维度下降数组计算矩阵reshape 矩阵维度转换代码实现 import numpy as np a = ...
目标检测之Faster-RCNN的pytorch代码详解(数据预处理篇)
首先贴上代码原作者的github:https://github.com/chenyuntc/simple-faster-rcnn-pytorch(非代码作者,博文只解释代码) 今天看完了simple- ...
目标检测之Faster-RCNN的pytorch代码详解(模型训练篇)
本文所用代码gayhub的地址:https://github.com/chenyuntc/simple-faster-rcnn-pytorch (非本人所写,博文只是解释代码) 好长时间没有发博客了 ...
Pytorch Sampler详解
关于为什么要用Sampler可以阅读一文弄懂Pytorch的DataLoader, DataSet, Sampler之间的关系. 本文我们会从源代码的角度了解Sampler. Sampler 首先需要 ...
目标检测之Faster-RCNN的pytorch代码详解(模型准备篇)
十月一的假期转眼就结束了,这个假期带女朋友到处玩了玩,虽然经济仿佛要陷入危机,不过没关系,要是吃不上饭就看书,吃精神粮食也不错,哈哈!开个玩笑,是要收收心好好干活了,继续写Faster-RCNN的代码 ...
Pytorch autograd,backward详解
平常都是无脑使用backward,每次看到别人的代码里使用诸如autograd.grad这种方法的时候就有点抵触,今天花了点时间了解了一下原理,写下笔记以供以后参考.以下笔记基于Pytorch1.0 ...
pytorch之nn.Conv1d详解
转自:https://blog.csdn.net/sunny_xsc1994/article/details/82969867,感谢分享 pytorch之nn.Conv1d详解
[转载]Pytorch详解NLLLoss和CrossEntropyLoss
[转载]Pytorch详解NLLLoss和CrossEntropyLoss 来源:https://blog.csdn.net/qq_22210253/article/details/85229988 ...
【小白学PyTorch】11 MobileNet详解及PyTorch实现
文章来自微信公众号[机器学习炼丹术].我是炼丹兄,欢迎加我微信好友交流学习:cyx645016617. @ 目录 1 背景 2 深度可分离卷积 2.2 一般卷积计算量 2.2 深度可分离卷积计算量 2 ...
【小白学PyTorch】21 Keras的API详解（上）卷积、激活、初始化、正则
[新闻]:机器学习炼丹术的粉丝的人工智能交流群已经建立,目前有目标检测.医学图像.时间序列等多个目标为技术学习的分群和水群唠嗑答疑解惑的总群,欢迎大家加炼丹兄为好友,加入炼丹协会.微信:cyx6450 ...

随机推荐

Linux 破解mysql密码
mysql忘记密码怎么办 [root@master ~]# mysql -uroot -pHuawei123123$ mysql: [Warning] Using a password on the ...
【郝斌C ST】02
自学视频<郝斌C语言自学教程> 10: https://www.bilibili.com/video/BV1os411h77o C语言大纲 - 1.简介 - 2.基本编译知识 - 3.数据 ...
人形机器人sim2real —— 致使现实环境与仿真环境下的差距的因素 —— sim2real
下图引自:https://b2b.baidu.com/q/aland?q=7B7474317C2E72330F621B0F7D6F09247E747E610623742B&id=qid599a ...
【转载】【技术杂谈】shell和terminal
分享视频: [技术杂谈]shell和terminal
MindSpore 初探，使用LeNet训练minist数据集
如题所述,官网地址: https://www.mindspore.cn/tutorial/zh-CN/r1.2/quick_start.html 数据集下载: mkdir -p ./datasets/ ...
Typora中的markdown语法的学习
markdown语法学习二级标题三级标题四级标题字体 hello world hello world hello world hello world 引用我是最nb的分割线图片 ctrl ...
5分钟说透chatgpt
5分钟说清楚 --到底它为啥能这么火? --到底牛逼在哪? --到底我能用来干嘛? 把"他"想象成一个博览群书的人想象一下,现在有一个知识非常渊博的一个人,博览群书,掌握了绝 ...
【DVWA】搭建安全测试环境
一.搭建DVWA环境用docker输入命令: docker run -d --name zc_dvwa -p 8081:80 vulnerables/web-dvwa 安装完成: 输入地址:http ...
理解async 和 await
await 后面接的是promise,await语句下面(注意:不是await后面,而是await所在语句的下面,即下行以后)的代码就相当在promise.then()里面执行,有文章说 await后 ...
Openstack-dashboard默认配额
创建实例不超过10个方法一修改配置文件在使用openstack的过程中,默认创建的实例最多10个,这是因为配额默认实例就是10 所以我们需要修改配置文件/etc/nova/nova.conf中的 ...

【PyTorch】state_dict详解

这篇博客来自csdn，完全用于学习。

Introduce

Sample

【PyTorch】state_dict详解的更多相关文章

随机推荐

热门专题