使用TensorFlow的递归神经网络（LSTM）进行序列预测

本篇文章介绍使用TensorFlow的递归神经网络（LSTM）进行序列预测。作者在网上找到的使用LSTM模型的案例都是解决自然语言处理的问题，而没有一个是来预测连续值的。

所以呢，这里是基于历史观察数据进行实数序列的预测。传统的神经网络模型并不能解决这种问题，进而开发出递归神经网络模型，递归神经网络模型可以存储历史数据来预测未来的事情。

在这个例子里将预测几个函数：

正弦函数：sin

同时存在正弦函数和余弦函数：sin和cos

x＊sin(x)

首先，建立LSTM模型，lstm_model，这个模型有一系列的不同时间步的lstm单元（cell），紧跟其后的是稠密层。

def lstm_model(time_steps, rnn_layers, dense_layers=None):

     def lstm_cells(layers):

         if isinstance(layers[0], dict):

             return [tf.nn.rnn_cell.DropoutWrapper(tf.nn.rnn_cell.BasicLSTMCell(layer['steps']), layer['keep_prob'])

                     if layer.get('keep_prob') else tf.nn.rnn_cell.BasicLSTMCell(layer['steps'])

                     for layer in layers]

         return [tf.nn.rnn_cell.BasicLSTMCell(steps) for steps in layers]

     def dnn_layers(input_layers, layers):

         if layers and isinstance(layers, dict):

             return skflow.ops.dnn(input_layers,

                                   layers['layers'],

                                   activation=layers.get('activation'),

                                   dropout=layers.get('dropout'))

         elif layers:

             return skflow.ops.dnn(input_layers, layers)

         else:

             return input_layers

     def _lstm_model(X, y):

         stacked_lstm = tf.nn.rnn_cell.MultiRNNCell(lstm_cells(rnn_layers))

         x_ = skflow.ops.split_squeeze(1, time_steps, X)

         output, layers = tf.nn.rnn(stacked_lstm, x_, dtype=dtypes.float32)

         output = dnn_layers(output[-1], dense_layers)

         return skflow.models.linear_regression(output, y)

     return _lstm_model

所建立的模型期望输入数据的维度与（batch size，第一个lstm cell的时间步长time_step，特征数量num_features）相关。
接下来我们按模型所能接受的数据方式来准备数据。

def rnn_data(data, time_steps, labels=False):

    """

    creates new data frame based on previous observation

      * example:

        l = [1, 2, 3, 4, 5]

        time_steps = 2

        -> labels == False [[1, 2], [2, 3], [3, 4]]

        -> labels == True [2, 3, 4, 5]

    """

    rnn_df = []

    for i in range(len(data) - time_steps):

        if labels:

            try:

                rnn_df.append(data.iloc[i + time_steps].as_matrix())

            except AttributeError:

                rnn_df.append(data.iloc[i + time_steps])

        else:

            data_ = data.iloc[i: i + time_steps].as_matrix()

            rnn_df.append(data_ if len(data_.shape) > 1 else [[i] for i in data_])

    return np.array(rnn_df)

def split_data(data, val_size=0.1, test_size=0.1):

    """

    splits data to training, validation and testing parts

    """

    ntest = int(round(len(data) * (1 - test_size)))

    nval = int(round(len(data.iloc[:ntest]) * (1 - val_size)))

    df_train, df_val, df_test = data.iloc[:nval], data.iloc[nval:ntest], data.iloc[ntest:]

    return df_train, df_val, df_test

def prepare_data(data, time_steps, labels=False, val_size=0.1, test_size=0.1):

    """

    Given the number of `time_steps` and some data.

    prepares training, validation and test data for an lstm cell.

    """

    df_train, df_val, df_test = split_data(data, val_size, test_size)

    return (rnn_data(df_train, time_steps, labels=labels),

            rnn_data(df_val, time_steps, labels=labels),

            rnn_data(df_test, time_steps, labels=labels))

def generate_data(fct, x, time_steps, seperate=False):

    """generate data with based on a function fct"""

    data = fct(x)

    if not isinstance(data, pd.DataFrame):

        data = pd.DataFrame(data)

    train_x, val_x, test_x = prepare_data(data['a'] if seperate else data, time_steps)

    train_y, val_y, test_y = prepare_data(data['b'] if seperate else data, time_steps, labels=True)

    return dict(train=train_x, val=val_x, test=test_x), dict(train=train_y, val=val_y, test=test

这将会创建一个数据让模型可以查找过去time_steps步来预测数据。比如，LSTM模型的第一个cell是10 time_steps cell，为了做预测我们需要输入10个历史数据点。y值跟我们想预测的第十个值相关。
现在创建一个基于LSTM模型的回归量。

regressor = skflow.TensorFlowEstimator(model_fn=lstm_model(TIMESTEPS, RNN_LAYERS, DENSE_LAYERS),

                                       n_classes=0,

                                       verbose=1,

                                       steps=TRAINING_STEPS,

                                       optimizer='Adagrad',

                                       learning_rate=0.03,

                                       batch_size=BATCH_SIZE)

预测sin函数

X, y = generate_data(np.sin, np.linspace(0, 100, 10000), TIMESTEPS, seperate=False)

# create a lstm instance and validation monitor

validation_monitor = skflow.monitors.ValidationMonitor(X['val'], y['val'], n_classes=0,

                                                       print_steps=PRINT_STEPS,

                                                       early_stopping_rounds=1000,

                                                       logdir=LOG_DIR)

regressor.fit(X['train'], y['train'], validation_monitor, logdir=LOG_DIR)

# > last training steps

# Step #9700, epoch #119, avg. train loss: 0.00082, avg. val loss: 0.00084

# Step #9800, epoch #120, avg. train loss: 0.00083, avg. val loss: 0.00082

# Step #9900, epoch #122, avg. train loss: 0.00082, avg. val loss: 0.00082

# Step #10000, epoch #123, avg. train loss: 0.00081, avg. val loss: 0.00081

预测测试数据

mse = mean_squared_error(regressor.predict(X['test']), y['test'])

print ("Error: {}".format(mse))

# 0.000776

真实sin函数

预测sin函数

预测sin和cos混合函数

def sin_cos(x):

    return pd.DataFrame(dict(a=np.sin(x), b=np.cos(x)), index=x)

X, y = generate_data(sin_cos, np.linspace(0, 100, 10000), TIMESTEPS, seperate=False)

# create a lstm instance and validation monitor

validation_monitor = skflow.monitors.ValidationMonitor(X['val'], y['val'], n_classes=0,

                                                       print_steps=PRINT_STEPS,

                                                       early_stopping_rounds=1000,

                                                       logdir=LOG_DIR)

regressor.fit(X['train'], y['train'], validation_monitor, logdir=LOG_DIR)

# > last training steps

# Step #9500, epoch #117, avg. train loss: 0.00120, avg. val loss: 0.00118

# Step #9600, epoch #118, avg. train loss: 0.00121, avg. val loss: 0.00118

# Step #9700, epoch #119, avg. train loss: 0.00118, avg. val loss: 0.00118

# Step #9800, epoch #120, avg. train loss: 0.00118, avg. val loss: 0.00116

# Step #9900, epoch #122, avg. train loss: 0.00118, avg. val loss: 0.00115

# Step #10000, epoch #123, avg. train loss: 0.00117, avg. val loss: 0.00115

预测测试数据

mse = mean_squared_error(regressor.predict(X['test']), y['test'])

print ("Error: {}".format(mse))

# 0.001144

真实的sin_cos函数

预测的sin_cos函数

预测x*sin函数

def x_sin(x):

     return x * np.sin(x)

 X, y = generate_data(x_sin, np.linspace(0, 100, 10000), TIMESTEPS, seperate=False)

 # create a lstm instance and validation monitor

 validation_monitor = skflow.monitors.ValidationMonitor(X['val'], y['val'], n_classes=0,

                                                        print_steps=PRINT_STEPS,

                                                        early_stopping_rounds=1000,

                                                        logdir=LOG_DIR)

 regressor.fit(X['train'], y['train'], validation_monitor, logdir=LOG_DIR)

 # > last training steps

 # Step #32500, epoch #401, avg. train loss: 0.48248, avg. val loss: 15.98678

 # Step #33800, epoch #417, avg. train loss: 0.47391, avg. val loss: 15.92590

 # Step #35100, epoch #433, avg. train loss: 0.45570, avg. val loss: 15.77346

 # Step #36400, epoch #449, avg. train loss: 0.45853, avg. val loss: 15.61680

 # Step #37700, epoch #465, avg. train loss: 0.44212, avg. val loss: 15.48604

 # Step #39000, epoch #481, avg. train loss: 0.43224, avg. val loss: 15.43947

预测测试数据

mse = mean_squared_error(regressor.predict(X['test']), y['test'])

print ("Error: {}".format(mse))

# 61.024454351

真实的x*sin函数

预测的x*sin函数

使用TensorFlow的递归神经网络（LSTM）进行序列预测的更多相关文章

TensorFlow(十一)：递归神经网络（RNN与LSTM）
RNN RNN(Recurrent Neural Networks,循环神经网络)不仅会学习当前时刻的信息,也会依赖之前的序列信息.由于其特殊的网络模型结构解决了信息保存的问题.所以RNN对处理时间序 ...
递归神经网络之理解长短期记忆网络（LSTM NetWorks）（转载）
递归神经网络人类并不是每时每刻都从头开始思考.正如你阅读这篇文章的时候,你是在理解前面词语的基础上来理解每个词.你不会丢弃所有已知的信息而从头开始思考.你的思想具有持续性. 传统的神经网络不能做到这 ...
学习笔记CB010:递归神经网络、LSTM、自动抓取字幕
递归神经网络可存储记忆神经网络,LSTM是其中一种,在NLP领域应用效果不错. 递归神经网络(RNN),时间递归神经网络(recurrent neural network),结构递归神经网络(recu ...
机器学习与Tensorflow（6）——LSTM的Tensorflow实现、Tensorboard简单实现、CNN应用
最近写的一些程序以及做的一个关于轴承故障诊断的程序最近学习进度有些慢而且马上假期要去补习班去赚下学期生活费额.... 抓紧时间再多学习点 1.RNN递归神经网络Tensorflow实现程序 ...
tensorflow实现循环神经网络
包括卷积神经网络(CNN)在内的各种前馈神经网络模型, 其一次前馈过程的输出只与当前输入有关与历史输入无关. 递归神经网络(Recurrent Neural Network, RNN)充分挖掘了序列数 ...
递归神经网络(RNN)简介（转载）
在此之前,我们已经学习了前馈网络的两种结构--多层感知器和卷积神经网络,这两种结构有一个特点,就是假设输入是一个独立的没有上下文联系的单位,比如输入是一张图片,网络识别是狗还是猫.但是对于一些有明显的 ...
tensorflow笔记：多层LSTM代码分析
tensorflow笔记:多层LSTM代码分析标签(空格分隔): tensorflow笔记 tensorflow笔记系列: (一) tensorflow笔记:流程,概念和简单代码注释 (二) ten ...
Tensorflow实例：利用LSTM预测股票每日最高价（一）
RNN与LSTM 这一部分主要涉及循环神经网络的理论,讲的可能会比较简略. 什么是RNN RNN全称循环神经网络(Recurrent Neural Networks),是用来处理序列数据的.在传统的神 ...
十 | 门控循环神经网络LSTM与GRU（附python演练）
欢迎大家关注我们的网站和系列教程:http://panchuang.net/ ,学习更多的机器学习.深度学习的知识! 目录: 门控循环神经网络简介长短期记忆网络(LSTM) 门控制循环单元(GRU) ...

随机推荐

Web API与JWT认证
JWT(Json Web Token)定义了一种使用Json形式在网络间安全地传递信息的简洁开放的标准(RFC 7519).JWT使用数字签名确保信息是可信的. 一.Session认证和Token认 ...
[iOS]深入理解GCD
看到一篇很好的文章,本来想翻译的,但发现已经有人翻译了,遂简单整理了一下,方便阅读学习新博客[wossoneri.com] 什么是GCD GCD(Grand Central Dispatch)是li ...
.Net Core 2.0 生态（2）.NET Core 2.0 特性介绍和使用指南
.NET Core 2.0发布日期:2017年8月14日前言这一篇会比较长,介绍了.NET Core 2.0新特性.工具支持及系统生态,现状及未来计划,可以作为一门技术的概述来读,也可以作为学习路 ...
Scala之List,Set及Map基本操作
package big.data.analyse.dataSet import scala.collection.immutable.{TreeMap, TreeSet} import scala.c ...
WebStorm连接Github教程
上学期刚开学的时候看过一次git相关的内容,很久没用过,忘了,两个月前又看了一次还精心做了笔记,也没有具体使用,又忘了,所以,避免又双叒叕忘了,我决定正式把git用起来.刚开始是通过Git Bash来 ...
python第四十九天--paramiko模块安装大作战
准备开始学习:paramiko模块,发现这个模块十分难搞安装不上搞了半天,win10 64下 pytyon 3.6 的 paramiko模块死活安不上,在网上不断的找资料,可是没有用,没有用啊 ...
SpringBoot整合Rabbitmq设置消息请求头
String str = "{\"origin\":\"BBC\",\"origin_coupon_id\":51,\" ...
EntityFramework Code-First 简易教程（七）-------领域类配置之Fluent API
Fluent API配置: 前面我们已经了解到使用DataAnotations特性来覆写Code-First默认约定,现在我们来学习Fluent API. Fluent API是另一种配置领域类的方法 ...
[SequenceFile_2] SequenceFile 的基本操作
0. 说明测试序列文件的读写操作 && 测试序列文件的排序操作 && 测试序列文件的合并操作 && 测试序列文件的压缩方式 && 测试 ...
Opengl正交矩阵 glOrthof 数学原理（转）
http://blog.sina.com.cn/s/blog_6084f588010192ug.html 在opengles1.1中设置正交矩阵只要一个函数调用就可以了:glOrthof,但是open ...

使用TensorFlow的递归神经网络（LSTM）进行序列预测

使用TensorFlow的递归神经网络（LSTM）进行序列预测的更多相关文章

随机推荐

热门专题