1.使用RNN做MNIST分类

第一次用LSTM,从简单做起吧~~

注意事项：

batch_first=True 意味着输入的格式为（batch_size,time_step,input_size),False 意味着输入的格式为（time_step,batch_size,input_size)
取r_out[:,-1,:]，即取时间步最后一步的结果，相当于LSTM把一张图片全部扫描完后的返回的状态向量（此时的维度变为（64，64），前面的64是batch_size,后面的64是隐藏层的神经元个数）

 import torch

 from torch.autograd import Variable

 from torchvision import datasets,transforms

 #超参数

 EPOCH=1

 BATCH_SIZE=64

 TIME_STEP=28#run time step/image height

 INPUT_SIZE=28#run input size/image width

 LR=0.01

 DOWNLOAD_MNIST=True

 train_data=datasets.MNIST(root='./mnist',train=True,transform=transforms.ToTensor(),download=DOWNLOAD_MNIST)

 train_loader=torch.utils.data.DataLoader(dataset=train_data,batch_size=BATCH_SIZE,shuffle=True)

 test_data=datasets.MNIST(root='./mnist',train=False,transform=transforms.ToTensor(),download=DOWNLOAD_MNIST)

 test_loader=torch.utils.data.DataLoader(dataset=test_data,batch_size=BATCH_SIZE,shuffle=True)

 class RNN(torch.nn.Module):

     def __init__(self):

         super(RNN,self).__init__()

         self.rnn=torch.nn.LSTM(

             input_size=INPUT_SIZE,

             hidden_size=64,

             num_layers=1,

             batch_first=True,

         )

         self.out=torch.nn.Linear(64,10)

     def forward(self, x):

         r_out,(h_n,h_c)=self.rnn(x,None)#[64,28,64]

         out=self.out(r_out[:,-1,:])#[64,10]

         return out

 #time_step,batch,input  batch_first=False,

 rnn=RNN()

 print(rnn)

 optimizer=torch.optim.Adam(rnn.parameters(),lr=LR)

 loss_func=torch.nn.CrossEntropyLoss()

 for epoch in range(EPOCH):

     for step,(x,y) in enumerate(train_loader):

         b_x=Variable(x.view(-1,28,28))#reshape x to (batch,time_step.input_size)

         b_y=Variable(y).squeeze()

         output=rnn(b_x)

         loss=loss_func(output,b_y)

         optimizer.zero_grad()

         loss.backward()

         optimizer.step()

         if step %50==0:

             for test_x,test_y in test_loader:

                 test_output=rnn(test_x.view(-1,28,28))

                 pred_y=torch.max(test_output,1)[1].data.numpy().squeeze()

                 test_y=test_y.numpy()

                 acc=sum(pred_y==test_y)/test_y.size

                 print(acc)

1.使用RNN做MNIST分类的更多相关文章

芝麻HTTP：TensorFlow LSTM MNIST分类
本节来介绍一下使用 RNN 的 LSTM 来做 MNIST 分类的方法,RNN 相比 CNN 来说,速度可能会慢,但可以节省更多的内存空间. 初始化首先我们可以先初始化一些变量,如学习率.节点单元数 ...
2.使用RNN做诗歌生成
诗歌生成比分类问题要稍微麻烦一些,而且第一次使用RNN做文本方面的问题,还是有很多概念性的东西~~~ 数据下载: 链接:https://pan.baidu.com/s/1uCDup7U5rGuIlIb ...
使用CNN做文本分类——将图像2维卷积换成1维
使用CNN做文本分类 from __future__ import division, print_function, absolute_import import tensorflow as tf ...
《机器学习系统设计》之应用scikit-learn做文本分类（上）
前言: 本系列是在作者学习<机器学习系统设计>([美] WilliRichert)过程中的思考与实践,全书通过Python从数据处理.到特征project,再到模型选择,把机器学习解决这个 ...
Tensorflow实战第十课（RNN MNIST分类）
设置RNN的参数我们本节采用RNN来进行分类的训练(classifiction).会继续使用手写数据集MNIST. 让RNN从每张图片的第一行像素读到最后一行,然后进行分类判断.接下来我们导入MNI ...
深度学习原理与框架-Tensorflow卷积神经网络-卷积神经网络mnist分类 1.tf.nn.conv2d(卷积操作) 2.tf.nn.max_pool(最大池化操作) 3.tf.nn.dropout(执行dropout操作) 4.tf.nn.softmax_cross_entropy_with_logits(交叉熵损失) 5.tf.truncated_normal(两个标准差内的正态分布)
1. tf.nn.conv2d(x, w, strides=[1, 1, 1, 1], padding='SAME') # 对数据进行卷积操作参数说明:x表示输入数据,w表示卷积核, stride ...
TensorFlow入门（三）多层 CNNs 实现 mnist分类
欢迎转载,但请务必注明原文出处及作者信息. 深入MNIST refer: http://wiki.jikexueyuan.com/project/tensorflow-zh/tutorials/mni ...
用keras的cnn做人脸分类
keras介绍 Keras是一个简约,高度模块化的神经网络库.采用Python / Theano开发. 使用Keras如果你需要一个深度学习库: 可以很容易和快速实现原型(通过总模块化,极简主义,和可 ...
tensorflow RNN循环神经网络 (分类例子)-【老鱼学tensorflow】
之前我们学习过用CNN(卷积神经网络)来识别手写字,在CNN中是把图片看成了二维矩阵,然后在二维矩阵中堆叠高度值来进行识别. 而在RNN中增添了时间的维度,因为我们会发现有些图片或者语言或语音等会在时 ...

随机推荐

JS异常
当 JavaScript 引擎执行 JavaScript 代码时,会发生各种错误. 可能是语法错误,通常是程序员造成的编码错误或错别字. 可能是拼写错误或语言中缺少的功能(可能由于浏览器差异). 可能 ...
【CF1133E】K Balanced Teams（动态规划，单调队列）
[CF1133E]K Balanced Teams(动态规划,单调队列) 题面 CF 让你把一堆数选一些出来分成不超过\(K\)组,每一组里面的最大值和最小值之差不超过\(5\),求最多有多少个人元素 ...
python版接口自动化测试框架源码完整版（requests + unittest）
python版接口自动化测试框架:https://gitee.com/UncleYong/my_rf [框架目录结构介绍] bin: 可执行文件,程序入口 conf: 配置文件 core: 核心文件 ...
微信小程序wepy框架开发资源汇总
开源项目 wepy-wechat-demo:基于wepy开发的仿微信聊天界面小程序深大的树洞:基于wepy开发的树洞类微信小程序 wepy-demo-bookmall:微信小程序
Swagger - ui 学习
今天同组的打伙伴给介绍了 Swagger-ui 这个自动生成接口文档的工具,感觉比较方便好用, 遂决定学习一下, 开个随笔进行随时记录,同时也是提醒自己先保存两篇感觉还不错的文章 : htt ...
Docker：基础介绍 [一]
一.Docker介绍 Docker是Docker.lnc公司开源的一个基于LXC技术之上构建的Container容器引擎,源代码托管在Github上,基于Go语言并遵从Apache2.0协议开源 Do ...
页面加载过渡页 loading plugin css
是前文 plugin 示例 loading 中需要用到的样式.现在样式扩充为 5类.loadtwo 使用到了bgimg /*loading animation loading one*/ /* loa ...
SSH框架之hibernate《二》
Hibernate第二天一.hibernate的持久化类和对象标识符 1.1持久化类的编写规范 1.1.1什么是持久化类: ...
MVC控制器返回一个list 视图接收
控制器 public ActionResult InfoFrame() { List<Users> list = new List<Users>(); if (Session[ ...
Django过滤器
在项目目录下建立templatetags文件夹建立 my_filter.py文件 from django import template register = template.Library() ...

1.使用RNN做MNIST分类

1.使用RNN做MNIST分类的更多相关文章

随机推荐

热门专题