使用tensorflow实现了简单的rnn网络用来学习加法运算。

tensorflow 版本:1.1

import tensorflow as tf
from tensorflow.contrib import rnn class RNN():
def __init__(self, input_dim , hidden_dim , step_num , class_num,learning_rate):
# # tf Graph input
self.x = tf.placeholder("float", [None, step_num, input_dim])
self.y = tf.placeholder("float", [None, class_num])
# Define weights
weights = {
'out': tf.Variable(tf.random_normal([hidden_dim, hidden_dim])),
'sigout':tf.Variable(tf.random_normal([hidden_dim , class_num]))
}
biases = {
'out': tf.Variable(tf.random_normal([hidden_dim])),
'sigout':tf.Variable(tf.random_normal([class_num]))
}
# Unstack to get a list of 'step_num' tensors of shape (batch_size, input_dim)
x_unstack = tf.unstack(self.x, step_num, 1)
# Define a lstm cell with tensorflow
lstm_cell = rnn.BasicLSTMCell(hidden_dim, forget_bias=1.0) # Get lstm cell output
outputs, states = rnn.static_rnn(lstm_cell, x_unstack, dtype=tf.float32) # Linear activation, using rnn inner loop last output
pred = tf.matmul(outputs[-1], weights['out']) + biases['out']
sigmodout = tf.matmul(tf.nn.sigmoid(pred , 'relu') , weights['sigout']) + biases['sigout']
self.predict = tf.round(sigmodout)
correct_pred = tf.equal(self.predict , self.y)
self.accuracy = tf.reduce_mean(tf.cast(correct_pred, tf.float32))
cost = tf.reduce_sum(tf.abs(tf.subtract(sigmodout , self.y)))
self.loss = cost
tf.summary.scalar('acc' , self.accuracy)
tf.summary.scalar('cost' , cost)
self.merge_all = tf.summary.merge_all()
import random
import numpy as np
class DataProcess():
def __init__(self):
self.point = 0
self.max_integer = 10000
self.max_len = len(self.filter(bin(self.max_integer))) + 1
def nextBatch(self,batch_size , fake = False ,is_test = False):
x_batch = []
y_batch = []
t_batch = []
for i in range( 0 , batch_size):
a = random.randint(0,self.max_integer)
b = random.randint(0,self.max_integer)
if fake:
a = 1
b = 1
c = a + b
abin = self.process(a)
bbin = self.process(b)
cbin = self.process(c)
xa = np.array(abin)
xb = np.array(bbin)
x_ = np.concatenate((xa , xb),axis= 0)
y_ = np.array(cbin)
x_batch.append(x_.reshape(2,self.max_len))
y_batch.append(cbin)
if is_test:
temp = []
temp.append(a)
temp.append(b)
t_batch.append(temp)
# if not is_test:
return np.array(x_batch) , np.array(y_batch),np.array(t_batch)
# else:
# return np.array(x_batch) , np.array(y_batch) def process(self , str):
bstr = bin(str)
bstr = self.filter(bstr)
bstr = self.completion(bstr)
return bstr[::-1] def filter(self , bstr):
return bstr.replace('0b' , '') def completion(self , bstr):
lst = []
for num in list(bstr):
lst.append(int(num))
length = len(bstr)
for i in range(length , self.max_len):
lst.insert(0,0) return[ (float)(i) for i in lst]
import tensorflow as tf
import time
import os
from src.bitplus.Process import DataProcess
from src.bitplus.rnn import RNN dp = DataProcess()
tf.app.flags.DEFINE_float("learning_rate",0.01,'learning rate')
tf.app.flags.DEFINE_integer("training_iters",500000,'')
tf.app.flags.DEFINE_integer("batch_size",100,'')
tf.app.flags.DEFINE_integer("display_step",10,'')
tf.app.flags.DEFINE_integer("input_dim" , 2,'')
tf.app.flags.DEFINE_integer("steps_num" , dp.max_len,'')
tf.app.flags.DEFINE_integer("hidden_dim", dp.max_len * 2 ,'')
tf.app.flags.DEFINE_integer("class_num" , dp.max_len,'')
tf.app.flags.DEFINE_string("rnn_model",'rnn.model','')
FLAGS = tf.app.flags.FLAGS logfolder = time.strftime("%Y%m%d_%H%M%S", time.localtime()) def train():
rnn = RNN(FLAGS.input_dim , FLAGS.hidden_dim ,FLAGS.steps_num , FLAGS.class_num , FLAGS.learning_rate)
optimizer = tf.train.AdamOptimizer(learning_rate=FLAGS.learning_rate).minimize(rnn.loss)
init = tf.global_variables_initializer()
sess = tf.Session()
sess.run(init)
train_writer = tf.summary.FileWriter('../LOGS/'+logfolder,sess.graph)
step = 1
while step * FLAGS.batch_size < FLAGS.training_iters:
batch_x, batch_y ,_= dp.nextBatch(FLAGS.batch_size , False)
batch_x = batch_x.transpose((0, 2, 1))
# Run optimization op (backprop)
sess.run(optimizer, feed_dict={rnn.x: batch_x, rnn.y: batch_y})
if step % FLAGS.display_step == 0:
# Calculate batch loss
merge_all , loss , acc,predict= sess.run([rnn.merge_all ,rnn.loss ,rnn.accuracy,rnn.predict],feed_dict={rnn.x: batch_x, rnn.y: batch_y})
print("Iter " + str(step*FLAGS.batch_size) + ", Minibatch Loss= " + \
"{:.6f}".format(loss) + ", Training Accuracy= " + \
"{:.5f}".format(acc))
train_writer.add_summary(merge_all , step)
step += 1 print("Optimization Finished!")
train_writer.close()
saver = tf.train.Saver(tf.all_variables())
if not os.path.exists('model'):
os.mkdir('model')
saver.save(sess, './model/' + FLAGS.rnn_model)
def tModel(model):
rnn = RNN(FLAGS.input_dim , FLAGS.hidden_dim ,FLAGS.steps_num , FLAGS.class_num , FLAGS.learning_rate)
saver = tf.train.Saver()
init = tf.global_variables_initializer()
sess = tf.Session()
sess.run(init)
saver.restore(sess,model)
batch_x , batch_y , batch_test = dp.nextBatch(100 , False,True)
batch_x = batch_x.transpose((0, 2, 1))
predict = sess.run([rnn.predict],feed_dict={rnn.x: batch_x, rnn.y: batch_y}) for ndx in range(len(predict[0])):
print('%s + %s = %d(%d)'%(batch_test[ndx][0] , batch_test[ndx][1] , batch_test[ndx][0] + batch_test[ndx][1],bin2Ten(predict[0][ndx])))
print('pause!')
def bin2Ten(bin):
lst = []
for i in bin[::-1]:
lst.append(str(int(i)))
return int(''.join(lst) , base=2)
def main(_):
print('start...')
print('max len:' , dp.max_len)
# train()
tModel('./model/' + FLAGS.rnn_model)
if __name__ == '__main__':
tf.app.run()

使用tensorflow 构建rnn网络的更多相关文章

  1. TensorFlow之RNN:堆叠RNN、LSTM、GRU及双向LSTM

    RNN(Recurrent Neural Networks,循环神经网络)是一种具有短期记忆能力的神经网络模型,可以处理任意长度的序列,在自然语言处理中的应用非常广泛,比如机器翻译.文本生成.问答系统 ...

  2. TensorFlow 实现 RNN 入门教程

    转子:https://www.leiphone.com/news/201705/zW49Eo8YfYu9K03J.html 最近在看RNN模型,为简单起见,本篇就以简单的二进制序列作为训练数据,而不实 ...

  3. 第二十二节,TensorFlow中RNN实现一些其它知识补充

    一 初始化RNN 上一节中介绍了 通过cell类构建RNN的函数,其中有一个参数initial_state,即cell初始状态参数,TensorFlow中封装了对其初始化的方法. 1.初始化为0 对于 ...

  4. 第二十节,使用RNN网络拟合回声信号序列

    这一节使用TensorFlow中的函数搭建一个简单的RNN网络,使用一串随机的模拟数据作为原始信号,让RNN网络来拟合其对应的回声信号. 样本数据为一串随机的由0,1组成的数字,将其当成发射出去的一串 ...

  5. 深度学习原理与框架-递归神经网络-RNN_exmaple(代码) 1.rnn.BasicLSTMCell(构造基本网络) 2.tf.nn.dynamic_rnn(执行rnn网络) 3.tf.expand_dim(增加输入数据的维度) 4.tf.tile(在某个维度上按照倍数进行平铺迭代) 5.tf.squeeze(去除维度上为1的维度)

    1. rnn.BasicLSTMCell(num_hidden) #  构造单层的lstm网络结构 参数说明:num_hidden表示隐藏层的个数 2.tf.nn.dynamic_rnn(cell, ...

  6. 深度学习原理与框架-递归神经网络-RNN网络基本框架(代码?) 1.rnn.LSTMCell(生成单层LSTM) 2.rnn.DropoutWrapper(对rnn进行dropout操作) 3.tf.contrib.rnn.MultiRNNCell(堆叠多层LSTM) 4.mlstm_cell.zero_state(state初始化) 5.mlstm_cell(进行LSTM求解)

    问题:LSTM的输出值output和state是否是一样的 1. rnn.LSTMCell(num_hidden, reuse=tf.get_variable_scope().reuse)  # 构建 ...

  7. 解读tensorflow之rnn

    from: http://lan2720.github.io/2016/07/16/%E8%A7%A3%E8%AF%BBtensorflow%E4%B9%8Brnn/ 这两天想搞清楚用tensorfl ...

  8. 解读tensorflow之rnn 的示例 ptb_word_lm.py

    这两天想搞清楚用tensorflow来实现rnn/lstm如何做,但是google了半天,发现tf在rnn方面的实现代码或者教程都太少了,仅有的几个教程讲的又过于简单.没办法,只能亲自动手一步步研究官 ...

  9. language model ——tensorflow 之RNN

    代码结构 tf的代码看多了之后就知道其实官方代码的这个结构并不好: graph的构建和训练部分放在了一个文件中,至少也应该分开成model.py和train.py两个文件,model.py中只有一个P ...

随机推荐

  1. Try中如果发现错误,即跳出try去匹配catch,那么try后面的语句就不会被执行

    例:public void print() throws Exception. 对于方法a,如果它定义了throws Exception.那么当它调用的方法b返回异常对象时,方法a并不处理,而将这个异 ...

  2. 【BZOJ】1645: [Usaco2007 Open]City Horizon 城市地平线(线段树+特殊的技巧)

    http://www.lydsy.com/JudgeOnline/problem.php?id=1645 这题的方法很奇妙啊...一开始我打了一个“离散”后的线段树.............果然爆了. ...

  3. php7 宏杂记

    php.h                                 zend_api.h ZEND_FN(name) ---> zif_##name PHP_FUNCTION(name) ...

  4. WTL:下载、安装、初见

    简介 WTL: Windows Template Library 基于ATL对Win32 API的封装 C++库,用于开发Windows应用程序和UI组件 WTL功能不如MFC完善,但比MFC更小巧更 ...

  5. ASP.NET MVC - The view must derive from WebViewPage, or WebViewPage<TModel>

    当通过一个空的站点构建ASP.NET MVC时经常会出现各种配置缺少的问题,最简单但的办法是吧VS自动生成的web.config文件拷贝到对应的目录下面 The view must derive fr ...

  6. 如何隐藏js

    前端好像一直会遇到js容易被查看的问题,针对这种情况,如何隐藏js呢? 突发奇想,想到一个办法,如果说一段js只需要执行一次的话 可以尝试在所有js加载操作完毕后把它去掉.看代码 <!DOCTY ...

  7. Python UnboundLocalError 异常

    如下,当我们在函数中对全局变量重新赋值的时候就会出现 UnboundLocalError 异常,虽然 num 这个变量在外部已经被定义成全局变量,但是如果在函数中进行重新赋值操作,python 会自动 ...

  8. js修改剪切板内容的方法

    代码如下: //绑定在了body上,也可以绑定在其他可用元素行,但是不是所有元素都支持copy事件. $(document.body).bind({ copy: function(e) {//copy ...

  9. 使用 awk 过滤文本或文件中的字符串

    当我们在 Unix/Linux 下使用特定的命令从字符串或文件中读取或编辑文本时,我们经常需要过滤输出以得到感兴趣的部分.这时正则表达式就派上用场了. 什么是正则表达式? 正则表达式可以定义为代表若干 ...

  10. Json数组基础知识

    1.对象是一个无序的“‘名称/值’对”集合. (1)一个对象以“{”(左括号)开始,“}”(右括号)结束. (2)每个“名称”后跟一个“:”(冒号): (3)“‘名称/值’ 对”之间使用“,”(逗号) ...