前向传播和反向传播实战（Tensor）

前面在mnist中使用了三个非线性层来增加模型复杂度，并通过最小化损失函数来更新参数，下面实用最底层的方式即张量进行前向传播（暂不采用层的概念）。

主要注意点如下：

　　· 进行梯度运算时，tensorflow只对tf.Variable类型的变量进行记录，而不对tf.Tensor或者其他类型的变量记录

　　· 进行梯度更新时，如果采用赋值方法更新即w1=w1+x的形式，那么所得的w1是tf.Tensor类型的变量，所以要采用原地更新的方式即assign_sub函数，或者再次使用tf.Variable包起来（不推荐）

代码如下：

import tensorflow as tf

from tensorflow import keras

from tensorflow.keras import datasets

import os

os.environ['TF_CPP_MIN_LOG_LEVEL']=''

# x:[60k,28,28]

# y:[60k]

(x,y),_=datasets.mnist.load_data()

x = tf.convert_to_tensor(x,dtype=tf.float32)/255.0

y = tf.convert_to_tensor(y,dtype=tf.int32)

print(x.shape,y.shape,x.dtype,y.dtype)

print(tf.reduce_min(x),tf.reduce_max(x))

print(tf.reduce_min(y),tf.reduce_max(y))

train_db=tf.data.Dataset.from_tensor_slices((x,y)).batch(128)

train_iter=iter(train_db)

sample=next(train_iter)

print('batch:',sample[0].shape,sample[1].shape)

# [b,784]=>[b,256]=>[b,128]=>[b,10]

# w shape[dim_in,dim_out] b shape[dim_out]

w1 = tf.Variable(tf.random.truncated_normal([784,256],stddev=0.1))

b1 = tf.Variable(tf.zeros([256]))

w2 = tf.Variable(tf.random.truncated_normal([256,128],stddev=0.1))

b2 = tf.Variable(tf.zeros([128]))

w3 = tf.Variable(tf.random.truncated_normal([128,10],stddev=0.1))

b3 = tf.Variable(tf.zeros([10]))

# 设置学习率

lr = 0.001

for epoch in range(10): # 对数据集迭代

    for step,(x,y) in enumerate(train_db):

        # x:[128,28,28] y:[128]

        x = tf.reshape(x,[-1,28*28])

        with tf.GradientTape() as tape: # tape只会跟踪tf.Variable

            # x:[b,28*28]

            # [b,784]@[784,256]+[256]=>[b,256]+[256]

            h1 = x@w1 + b1

            h1 = tf.nn.relu(h1) # 去线性化

            h2 = h1@w2 + b2

            h2 = tf.nn.relu(h2) # 去线性化

            out = h2@w3 + b3

            # 计算损失

            y_onehot = tf.one_hot(y,depth=10)

            # mse = mean(sum(y-out)^2)

            loss = tf.square(y_onehot - out)

            # mean:scalar

            loss = tf.reduce_mean(loss)

        # 计算梯度

        grads = tape.gradient(loss,[w1,b1,w2,b2,w3,b3])

        # w1 = w1 -lr * w1_grad

        w1.assign_sub(lr * grads[0]) # 原地更新

        b1.assign_sub(lr * grads[1])

        w2.assign_sub(lr * grads[2])

        b2.assign_sub(lr * grads[3])

        w3.assign_sub(lr * grads[4])

        b3.assign_sub(lr * grads[5])

        if step % 100 == 0:

            print('epoch = ',epoch,'step =',step,'，loss =',float(loss))

效果如下：

前向传播和反向传播实战（Tensor）的更多相关文章

机器学习（ML）八之正向传播、反向传播和计算图，及数值稳定性和模型初始化
正向传播正向传播的计算图通常绘制计算图来可视化运算符和变量在计算中的依赖关系.下图绘制了本节中样例模型正向传播的计算图,其中左下角是输入,右上角是输出.可以看到,图中箭头方向大多是向右和向上,其中 ...
小白学习之pytorch框架(6)-模型选择(K折交叉验证)、欠拟合、过拟合(权重衰减法(=L2范数正则化)、丢弃法)、正向传播、反向传播
下面要说的基本都是<动手学深度学习>这本花书上的内容,图也采用的书上的首先说的是训练误差(模型在训练数据集上表现出的误差)和泛化误差(模型在任意一个测试数据集样本上表现出的误差的期望) ...
caffe中 softmax 函数的前向传播和反向传播
1.前向传播: template <typename Dtype> void SoftmaxLayer<Dtype>::Forward_cpu(const vector< ...
caffe中的前向传播和反向传播
caffe中的网络结构是一层连着一层的,在相邻的两层中,可以认为前一层的输出就是后一层的输入,可以等效成如下的模型可以认为输出top中的每个元素都是输出bottom中所有元素的函数.如果两个神经元之 ...
BP原理 - 前向计算与反向传播实例
Outline 前向计算反向传播很多事情不是需要聪明一点,而是需要耐心一点,踏下心来认真看真的很简单的. 假设有这样一个网络层: 第一层是输入层,包含两个神经元i1 i2和截距b1: 第二层是隐含 ...
反向传播算法（前向传播、反向传播、链式求导、引入delta）
参考链接: 一文搞懂反向传播算法
Tensorflow笔记——神经网络图像识别（一）前反向传播，神经网络八股
第一讲:人工智能概述第三讲:Tensorflow框架前向传播: 反向传播: 总的代码: #coding:utf-8 #1.导入模块,生成模拟数据集 import t ...
BP神经网络反向传播之计算过程分解（详细版）
摘要:本文先从梯度下降法的理论推导开始,说明梯度下降法为什么能够求得函数的局部极小值.通过两个小例子,说明梯度下降法求解极限值实现过程.在通过分解BP神经网络,详细说明梯度下降法在神经网络的运算过程, ...
深度学习与CV教程(4) | 神经网络与反向传播
作者:韩信子@ShowMeAI 教程地址:http://www.showmeai.tech/tutorials/37 本文地址:http://www.showmeai.tech/article-det ...

随机推荐

Android客户端OkHttp的使用以及tomcat服务器的解析客户端发过来的数据
2020-02-15 21:25:42 ### android客户端客户向服务器发送json字符串或者以参数请求的方式发送数据其中又分为post请求和get请求 1.activity.xml < ...
ARTS Week 3
Nov 11,2019 ~ Nov 17,2019 Algorithm 本周来介绍快速求一个数字n次方的余数. 理论基础我们先定义运算$ x \bmod p = r $与$ x \equiv r ...
To be contine ,NW NMM backup sqlserver failed.
Last time, we talk about separate under one cluster backup into two diffetent AG backup. Does it wor ...
k8s系列---hpa扩容
centos-master:172.16.100.60 centos-minion:172.16.100.62 k8s,etcd,docker等都是采用yum装的,部署参考的k8s权威指南和一个视频, ...
shell脚本 server httpd 控制程序
原版的脚本里查看status 需要用 lynx这个命令,还要开启http://localhost:80/server-status 比较麻烦,我直接注释了,新加的代码用红色字体 ...
Vscode开发Java环境搭建
VSCode 开发 JAVA 微软为 Java 开发者推出了一个 Visual Studio Code 的安装程序.Visual Studio Code 中目前提供了许多 Java 扩展. 该软件包可 ...
Centos7.5中Nginx报错：nginx: [error] invalid PID number "" in "/run/nginx.pid" 解决方法
服务器重启之后,执行 nginx -t 是OK的,然而在执行 nginx -s reload 的时候报错 nginx: [error] invalid PID number "" ...
docker容器互联，实现目录、服务共享
一.需求 docker使服务之间实现容器隔离,比如Javaweb项目前端.后端.数据库.数据库后台,分别把它们部署在不同的容器里面,实现隔离.但服务和服务之间也有互访的需求,这就涉及到容器网络和容器互 ...
Jenkins新建节点找不到通过Java web启动代理？
参考博客:Jenkins新建节点,启动方式没有“通过Java Web启动代理”选项怎么办? 在Jenkins中,打开“系统管理”→“管理节点”→“新建节点”页面时,“启动方式”选项没有“通过Java ...
vue垂死挣扎系列（一）——vue-cli快速搭建
项目安装(windows10安装环境+vue-cli 2.x) 安装node 在官网上下载稳定版本的node node.js官网一路傻瓜安装测试是否安装成功 cmd中node --version ...

前向传播和反向传播实战（Tensor）

前向传播和反向传播实战（Tensor）的更多相关文章

随机推荐

热门专题