利用TensorFlow识别手写的数字---基于两层卷积网络

1 为什么使用卷积神经网络

Softmax回归是一个比较简单的模型，预测的准确率在91%左右，而使用卷积神经网络将预测的准确率提高到99%。

2 卷积网络的流程

3 代码展示

# -*- coding: utf-8 -*-

import tensorflow as tf

from tensorflow.examples.tutorials.mnist import input_data

#读入数据

mnist = input_data.read_data_sets("MNIST_data/",one_hot=True)

#x为训练图像的占位符，y_为训练图像标签的占位符

x = tf.placeholder(tf.float32,[None,784])

y_ = tf.placeholder(tf.float32,[None,10])

#将单张图片从784维向量重新还原为28*28的矩阵图片

x_image = tf.reshape(x,[-1,28,28,1]) #-1 表示任意的数，由实际输入的图像个数决定 

# 定义卷积过程中用到的函数

def weight_variable(shape):

    initial = tf.truncated_normal(shape,stddev=0.1) #产生正太分布

    return tf.Variable(initial)

def bias_variable(shape):

    initial = tf.constant(0.1,shape=shape)

    return tf.Variable(initial)

def conv2d(x,w):

    return tf.nn.conv2d(x,w,strides=[1,1,1,1],padding="SAME")

def max_pool_2x2(x):

    return tf.nn.max_pool(x,ksize=[1,2,2,1],strides=[1,2,2,1],padding="SAME")

# 第一层卷积

w_conv1 = weight_variable([5,5,1,32])

b_conv1 = bias_variable([32])

h_conv1 = tf.nn.relu(conv2d(x_image,w_conv1)+b_conv1)

h_pool1 = max_pool_2x2(h_conv1)

# 第二层卷积

w_conv2 = weight_variable([5,5,32,64])

b_conv2 = bias_variable([64])

h_conv2 = tf.nn.relu(conv2d(h_pool1,w_conv2)+b_conv2)

h_pool2 = max_pool_2x2(h_conv2)

# 第一层全连接层,输出1024维的向量

w_fc1 = weight_variable([7*7*64,1024])

b_fc1 = bias_variable([1024])

h_pool2_flat = tf.reshape(h_pool2,[-1,7*7*64])

h_fc1 = tf.nn.relu(tf.matmul(h_pool2_flat,w_fc1)+b_fc1)

#使用Dropout ,keep_prob 是一个占位符，训练是0.5，测试时为1

keep_prob = tf.placeholder(tf.float32)

h_fc1_drop = tf.nn.dropout(h_fc1,keep_prob)

# 第二层全连接层,输出1024维的向量

w_fc2 = weight_variable([1024,10])

b_fc2 = bias_variable([10])

y_conv = tf.matmul(h_fc1_drop,w_fc2)+b_fc2

# 不采用先softmax再计算交叉熵的办法

#采用tf.nn.softmax_cross_entropy_with_logits直接计算

cross_entropy = tf.reduce_mean(tf.nn.softmax_cross_entropy_with_logits(labels=y_,logits=y_conv))

#定义train_step

train_step = tf.train.AdamOptimizer(1e-4).minimize(cross_entropy)

#定义准确率

correct_prediction = tf.equal(tf.argmax(y_conv,1),tf.argmax(y_,1))

accuracy = tf.reduce_mean(tf.cast(correct_prediction,tf.float32))

# 训练

# 创建Session,对变量初始化

sess = tf.InteractiveSession()

sess.run(tf.global_variables_initializer())

#训练2000步

for i in range(2000):

    batch = mnist.train.next_batch(50)

    # 每一百步报告一次在验证集上的准确率

    if i % 100 == 0 :

        train_accuracy = accuracy.eval(feed_dict={x:batch[0],y_:batch[1],keep_prob:1})

        print("step %d,training accuracy %g" % (i,train_accuracy))

    train_step.run(feed_dict={x:batch[0],y_:batch[1],keep_prob:0.5})

# 训练结束后报告在测试集上的准确率

print("test_accuracy %g" % accuracy.eval(feed_dict={x:mnist.test.images,y_:mnist.test.labels,keep_prob:1.0}))

4 补充

步长stride是一个一维的向量，长度为4。形式是[a,x,y,z]，分别代表[batch滑动步长，水平滑动步长，垂直滑动步长，通道滑动步长]。在tensorflow中，stride的一般形式是[1，x，y，1]

第一个1表示：在batch维度上的滑动步长为1，即不跳过任何一个样本
x表示：卷积核的水平滑动步长
y表示：卷积核的垂直滑动步长
最后一个1表示：在通道维度上的滑动步长为1，即不跳过任何一个颜色通道

利用TensorFlow识别手写的数字---基于两层卷积网络的更多相关文章

利用TensorFlow识别手写的数字---基于Softmax回归
1 MNIST数据集 MNIST数据集主要由一些手写数字的图片和相应的标签组成,图片一共有10类,分别对应从0-9,共10个阿拉伯数字.原始的MNIST数据库一共包含下面4个文件,见下表. 训练图像一 ...
一文全解：利用谷歌深度学习框架Tensorflow识别手写数字图片（初学者篇）
笔记整理者:王小草笔记整理时间2017年2月24日原文地址 http://blog.csdn.net/sinat_33761963/article/details/56837466?fps=1&a ...
【转】机器学习教程十四-利用tensorflow做手写数字识别
模式识别领域应用机器学习的场景非常多,手写识别就是其中一种,最简单的数字识别是一个多类分类问题,我们借这个多类分类问题来介绍一下google最新开源的tensorflow框架,后面深度学习的内容都会基 ...
07 训练Tensorflow识别手写数字
打开Python Shell,输入以下代码: import tensorflow as tf from tensorflow.examples.tutorials.mnist import input ...
利用Tensorflow实现手写字符识别
模式识别领域应用机器学习的场景非常多,手写识别就是其中一种,最简单的数字识别是一个多类分类问题,我们借这个多类分类问题来介绍一下google最新开源的tensorflow框架,后面深度学习的内容都会基 ...
TensorFlow下利用MNIST训练模型并识别自己手写的数字
最近一直在学习李宏毅老师的机器学习视频教程,学到和神经网络那一块知识的时候,我觉得单纯的学习理论知识过于枯燥,就想着自己动手实现一些简单的Demo,毕竟实践是检验真理的唯一标准!!!但是网上很多的与t ...
OpenCV+TensorFlow图片手写数字识别(附源码)
初次接触TensorFlow,而手写数字训练识别是其最基本的入门教程,网上关于训练的教程很多,但是模型的测试大多都是官方提供的一些素材,能不能自己随便写一串数字让机器识别出来呢?纸上得来终觉浅,带着这 ...
3 TensorFlow入门之识别手写数字
------------------------------------ 写在开头:此文参照莫烦python教程(墙裂推荐!!!) ---------------------------------- ...
学习笔记TF024:TensorFlow实现Softmax Regression(回归)识别手写数字
TensorFlow实现Softmax Regression(回归)识别手写数字.MNIST(Mixed National Institute of Standards and Technology ...

随机推荐

selenium基础（脚本模块化）
selenium基础(脚本模块化)
13-8-return的高级使用
<!DOCTYPE html> <html lang="en"> <head> <meta charset="UTF-8&quo ...
统计学习笔记之k近邻法
1.kNN算法的思想:给定一个训练数据集,对新的输入实例,在训练集中找到与该实例最近邻的k个实例,这k个实例的多数属于某类,就把输入实例分为这个类. 2.算法 (1)根据给定的距离度量,在训练集T中找 ...
JS规则多样化的我(变量赋值）我们使用"="号给变量存储内容,你可以把任何东西存储在变量里，如数值、字符串、布尔值等，
多样化的我(变量赋值) 我们可以把变量看做一个盒子,盒子用来存放物品,那如何在变量中存储内容呢? 我们使用"="号给变量存储内容,看下面的语句: var mynum = 5 ; / ...
Pascal的sin^-1函数实现
function unsin(t:real):real; var l,r,ans,mid:longint; function dsin(z:real):real; begin exit(sin(z*p ...
html--图片背景兼容，兼容IE6
在IE6中对图片格式png24支持度不高, 如果使用的图片格式是png24,则会导致透明效果无法正常显示解决方法: 1.可以使用png8来代替png24,即可解决问题, 但是使用png8代替png2 ...
loj2494 [hnoi2018]寻宝游戏
题意:给你n个元素的数组a.你可以在每个元素之前添加and和or的符号.每次询问最后变成r有多少种添号情况. n<=1000,m<=5000,q<=1000. 标程: #includ ...
img属性src的特点
img属性src的特点: src=“图片地址” 成功则加载图片,失败则显示alt文字和断裂的图片 src="" 则不加载,不显示alt文字和断裂的图片因此当图片加载失败后,$(& ...
python中使用xlrd、xlwt操作excel
python 对 excel基本的操作如下: # -*- coding: utf-8 -*- import xlrd import xlwt from datetime import date,dat ...
2016.10.5初中部上午NOIP普及组比赛总结
2016.10.5初中部上午NOIP普及组比赛总结这次的题目出得挺有质量的.但我觉得我更应该努力了. 进度: 比赛:0+20+0+0=20 改题:AC+AC+AC+AC=AK kk的作业这题我错得 ...

利用TensorFlow识别手写的数字---基于两层卷积网络

1 为什么使用卷积神经网络

2 卷积网络的流程

3 代码展示

4 补充

利用TensorFlow识别手写的数字---基于两层卷积网络的更多相关文章

随机推荐

热门专题