前言

1.LSTM 航空乘客预测 单步预测和多步预测。 简单运用LSTM 模型进行预测分析。
2.加入注意力机制的LSTM 对航空乘客预测采用了目前市面上比较流行的注意力机制,将两者进行结合预测。
3.多层 LSTM 对航空乘客预测 简单运用多层的LSTM 模型进行预测分析。

本文采用双向LSTM网络对其进行预测。

我喜欢直接代码+ 结果展示
先代码可以跑通,才值得深入研究每个部分之间的关系;进而改造成自己可用的数据。

1 数据集

链接: https://pan.baidu.com/s/1jv7A2JvIhA6oqvtYnYh9vQ
提取码: m5j5

2 模型

双向LSTM是传统LSTM的扩展,在输入序列的所有时间步长可用的问题中,双向LSTM在输入序列上训练两个而不是一个LSTM。
输入序列中的第一个是原样的,第二个是输入序列的反转副本。这可以为网络提供额外的上下文,并导致更快,甚至更充分的学习问题

2.1 单步预测 1—》1

  • 代码
# 单变量,1---》1 import numpy
import matplotlib.pyplot as plt
from pandas import read_csv
import math
from keras.models import Sequential
from keras.layers import Dense
from keras.layers import LSTM
from keras.layers import Bidirectional
from sklearn.preprocessing import MinMaxScaler
from sklearn.metrics import mean_squared_error
#matplotlib inline# load the dataset
dataframe = read_csv('airline-passengers.csv', usecols=[1], engine='python')
# print(dataframe)
print("数据集的长度:",len(dataframe))
dataset = dataframe.values
# 将整型变为float
dataset = dataset.astype('float32')plt.plot(dataset)
plt.show()# X是给定时间(t)的乘客人数,Y是下一次(t + 1)的乘客人数。
# 将值数组转换为数据集矩阵,look_back是步长。
def create_dataset(dataset, look_back=1):dataX, dataY = [], []for i in range(len(dataset)-look_back-1):a = dataset[i:(i+look_back), 0]# X按照顺序取值dataX.append(a)# Y向后移动一位取值dataY.append(dataset[i + look_back, 0])return numpy.array(dataX), numpy.array(dataY)# fix random seed for reproducibility
numpy.random.seed(7)# 数据缩放
scaler = MinMaxScaler(feature_range=(0, 1))
dataset = scaler.fit_transform(dataset)# 将数据拆分成训练和测试,2/3作为训练数据
train_size = int(len(dataset) * 0.67)
test_size = len(dataset) - train_size
train, test = dataset[0:train_size,:], dataset[train_size:len(dataset),:]
print("原始训练集的长度:",train_size)
print("原始测试集的长度:",test_size)# 构建监督学习型数据
look_back = 1
trainX, trainY = create_dataset(train, look_back)
testX, testY = create_dataset(test, look_back)
print("转为监督学习,训练集数据长度:", len(trainX))
# print(trainX,trainY)
print("转为监督学习,测试集数据长度:",len(testX))
# print(testX, testY )
# 数据重构为3D [samples, time steps, features]
trainX = numpy.reshape(trainX, (trainX.shape[0], 1, trainX.shape[1]))
testX = numpy.reshape(testX, (testX.shape[0], 1, testX.shape[1]))
print('构造得到模型的输入数据(训练数据已有标签trainY): ',trainX.shape,testX.shape)# create and fit the LSTM network
model = Sequential()
model.add(Bidirectional(LSTM(4, input_shape=(1, look_back))))
model.add(Dense(1))
model.compile(loss='mean_squared_error', optimizer='adam')
model.fit(trainX, trainY, epochs=100, batch_size=1, verbose=2)# 打印模型
model.summary()# 开始预测
trainPredict = model.predict(trainX)
testPredict = model.predict(testX)# 逆缩放预测值
trainPredict = scaler.inverse_transform(trainPredict)
trainY = scaler.inverse_transform([trainY])
testPredict = scaler.inverse_transform(testPredict)
testY = scaler.inverse_transform([testY])# 计算误差
trainScore = math.sqrt(mean_squared_error(trainY[0], trainPredict[:,0]))
print('Train Score: %.2f RMSE' % (trainScore))
testScore = math.sqrt(mean_squared_error(testY[0], testPredict[:,0]))
print('Test Score: %.2f RMSE' % (testScore))# shift train predictions for plotting
trainPredictPlot = numpy.empty_like(dataset)
trainPredictPlot[:, :] = numpy.nan
trainPredictPlot[look_back:len(trainPredict)+look_back, :] = trainPredict# shift test predictions for plotting
testPredictPlot = numpy.empty_like(dataset)
testPredictPlot[:, :] = numpy.nan
testPredictPlot[len(trainPredict)+(look_back*2)+1:len(dataset)-1, :] = testPredict# plot baseline and predictions
plt.plot(scaler.inverse_transform(dataset))
plt.plot(trainPredictPlot)
plt.plot(testPredictPlot)
plt.show()
  • 结果
Train Score: 22.97 RMSE
Test Score: 48.23 RMSE

  • 预测下一个月的数据
# 预测未来的数据#测试数据的最后一个数据没有预测,这里补上
finalX = numpy.reshape(test[-1:], (1, testX.shape[1], 1))
print(finalX)#预测得到标准化数据
featruePredict = model.predict(finalX)#将标准化数据转换为人数
featruePredict = scaler.inverse_transform(featruePredict)#原始数据是1949-1960年的数据,下一个月是1961年1月份
print('模型预测1961年1月份的国际航班人数是: ',featruePredict)

结果展示:
模型预测1961年1月份的国际航班人数是: [[418.70108]]

2.2 单步预测 3—》1

  • 代码
# 单变量,3---》1 import numpy
import matplotlib.pyplot as plt
from pandas import read_csv
import math
from keras.models import Sequential
from keras.layers import Dense
from keras.layers import LSTM
from keras.layers import Bidirectional
from sklearn.preprocessing import MinMaxScaler
from sklearn.metrics import mean_squared_error
#matplotlib inline# load the dataset
dataframe = read_csv('airline-passengers.csv', usecols=[1], engine='python')
# print(dataframe)
print("数据集的长度:",len(dataframe))
dataset = dataframe.values
# 将整型变为float
dataset = dataset.astype('float32')plt.plot(dataset)
plt.show()# X是给定时间(t)的乘客人数,Y是下一次(t + 1)的乘客人数。
# 将值数组转换为数据集矩阵,look_back是步长。
def create_dataset(dataset, look_back=1):dataX, dataY = [], []for i in range(len(dataset)-look_back-1):a = dataset[i:(i+look_back), 0]# X按照顺序取值dataX.append(a)# Y向后移动一位取值dataY.append(dataset[i + look_back, 0])return numpy.array(dataX), numpy.array(dataY)# fix random seed for reproducibility
numpy.random.seed(7)# 数据缩放
scaler = MinMaxScaler(feature_range=(0, 1))
dataset = scaler.fit_transform(dataset)# 将数据拆分成训练和测试,2/3作为训练数据
train_size = int(len(dataset) * 0.67)
test_size = len(dataset) - train_size
train, test = dataset[0:train_size,:], dataset[train_size:len(dataset),:]
print("原始训练集的长度:",train_size)
print("原始测试集的长度:",test_size)# 构建监督学习型数据
look_back = 3
trainX, trainY = create_dataset(train, look_back)
testX, testY = create_dataset(test, look_back)
print("转为监督学习,训练集数据长度:", len(trainX))
# print(trainX,trainY)
print("转为监督学习,测试集数据长度:",len(testX))
# print(testX, testY )
# 数据重构为3D [samples, time steps, features]
# trainX = numpy.reshape(trainX, (trainX.shape[0], 1, trainX.shape[1]))
# testX = numpy.reshape(testX, (testX.shape[0], 1, testX.shape[1]))trainX = numpy.reshape(trainX, (trainX.shape[0],  trainX.shape[1],1))
testX = numpy.reshape(testX, (testX.shape[0], testX.shape[1], 1))print('构造得到模型的输入数据(训练数据已有标签trainY): ',trainX.shape,testX.shape)# create and fit the LSTM network
model = Sequential()
# model.add(LSTM(4, input_shape=(1, look_back)))
model.add(Bidirectional(LSTM(4, input_shape=( look_back,1)))) # 与上面的重构格式对应,要改都改,才能跑通代码
model.add(Dense(1))
model.compile(loss='mean_squared_error', optimizer='adam')
model.fit(trainX, trainY, epochs=100, batch_size=1, verbose=2)# 打印模型
model.summary()# 开始预测
trainPredict = model.predict(trainX)
testPredict = model.predict(testX)# 逆缩放预测值
trainPredict = scaler.inverse_transform(trainPredict)
trainY = scaler.inverse_transform([trainY])
testPredict = scaler.inverse_transform(testPredict)
testY = scaler.inverse_transform([testY])# 计算误差
trainScore = math.sqrt(mean_squared_error(trainY[0], trainPredict[:,0]))
print('Train Score: %.2f RMSE' % (trainScore))
testScore = math.sqrt(mean_squared_error(testY[0], testPredict[:,0]))
print('Test Score: %.2f RMSE' % (testScore))# shift train predictions for plotting
trainPredictPlot = numpy.empty_like(dataset)
trainPredictPlot[:, :] = numpy.nan
trainPredictPlot[look_back:len(trainPredict)+look_back, :] = trainPredict# shift test predictions for plotting
testPredictPlot = numpy.empty_like(dataset)
testPredictPlot[:, :] = numpy.nan
testPredictPlot[len(trainPredict)+(look_back*2)+1:len(dataset)-1, :] = testPredict# plot baseline and predictions
plt.plot(scaler.inverse_transform(dataset))
plt.plot(trainPredictPlot)
plt.plot(testPredictPlot)
plt.show()
  • 结果展示
Train Score: 23.13 RMSE
Test Score: 88.55 RMSE

  • 预测下一个月的数据
# 预测未来的数据#测试数据的最后一个数据没有预测,这里补上
finalX = numpy.reshape(test[-3:], (1, testX.shape[1], 1))
print(finalX)#预测得到标准化数据
featruePredict = model.predict(finalX)#将标准化数据转换为人数
featruePredict = scaler.inverse_transform(featruePredict)#原始数据是1949-1960年的数据,下一个月是1961年1月份
print('模型预测1961年1月份的国际航班人数是: ',featruePredict)

结果展示:
模型预测1961年1月份的国际航班人数是: [[337.3761]]

3 总结

  • 双向LSTM的预测效果在一些情况下,确实比单向LSTM的好,要具体看什么数据,什么情况下
  • 对LSTM网络的进一步扩充,就代码内部来看,改变了LSTM的输入格式

双向LSTM 对航空乘客预测相关推荐

  1. 加入注意力机制的LSTM 对航空乘客预测

    前言 这篇文章LSTM 航空乘客预测 单步预测和多步预测. 简单运用LSTM 模型进行预测分析. 想着可以进一步改进LSTM模型,就采用了目前市面上比较流行的注意力机制,将两者进行结合,对LSTM进行 ...

  2. LSTM 航空乘客预测单步预测的两种情况

    前言 近期回顾LSTM 做时间序列数据预测,网上也有很多的教程,在跑这个程序时,遇到一些问题,特此记录分享一下. 使用LSTM 进行单步预测和多步预测,LSTM 的输出格式要重新调整,简单演示,不调参 ...

  3. 时间序列预测——双向LSTM(Bi-LSTM)

      本文展示了使用双向LSTM(Bi-LSTM)进行时间序列预测的全过程,包含详细的注释.整个过程主要包括:数据导入.数据清洗.结构转化.建立Bi-LSTM模型.训练模型(包括动态调整学习率和earl ...

  4. tensorflow应用:双向LSTM神经网络手写数字识别

    tensorflow应用:双向LSTM神经网络手写数字识别 思路 Python程序1.建模训练保存 Tensorboard检查计算图及训练结果 打开训练好的模型进行预测 思路 将28X28的图片看成2 ...

  5. [论文笔记]基于 CNN+双向LSTM 实现服饰搭配的生成

    论文:<Learning Fashion Compatibility with Bidirectional LSTMs> 论文地址:https://arxiv.org/abs/1707.0 ...

  6. 使用TensorFlow概率预测航空乘客人数

    TensorFlow Probability uses structural time series models to conduct time series forecasting. In par ...

  7. 【ML】基于机器学习的房价预测研究(系列7:双向LSTM模型)

    写在前面: 首先感谢兄弟们的订阅,让我有创作的动力,在创作过程我会尽最大能力,保证作品的质量,如果有问题,可以私信我,让我们携手共进,共创辉煌. 本次实战的项目是:基于机器学习的房价预测研究(附完整代 ...

  8. Tensorflow 使用Bidirectional()包装器构建双向LSTM模型,预测DNA序列功能

    循环神经网络(RNN) 循环神经网络RNN能处理时间序列,过去几年中,应用 RNN 在语音识别,语言建模,翻译,图片描述等问题上已经取得一定成功,并且这个列表还在增长.RNN模型的一个代表是LSTM ...

  9. TensorFlow搭建双向LSTM实现时间序列预测(负荷预测)

    目录 I. 前言 II. 原理 III. 模型定义 IV. 训练和预测 V. 源码及数据 I. 前言 前面几篇文章中介绍的都是单向LSTM,这篇文章讲一下双向LSTM. 系列文章: 深入理解PyTor ...

最新文章

  1. 输入一个字符串,用子函数完成在字符串中找出ACSII码值最大的字符,将其放在第一个位置,并将该字符前的所有字符向后顺序移动
  2. 自定义注解实现日志脱敏
  3. Linux之sed:修改器按照字符和行数进行筛选和替换行值 选项[动作
  4. 客户端登录提示找不到表0
  5. leetcode 1. 两数之和 思考分析
  6. 2000元档855旗舰来了 网友:都过时了,哪有人买
  7. javascript的prototype继承问题
  8. 如何使用JS来开发室内地图商场停车场车位管理系统
  9. ffmpeg转MP4 moov头在前命令
  10. php 无法识别oci8,php 连接oracle 无法 启用oci8 解决办法 (摘自oracle官网)
  11. Android实时直播,一千行java搞定不依赖jni,延迟0.8至3秒,强悍移动端来袭
  12. python3调用arcpy地理加权回归_地理加权回归( GWR)
  13. 手势密码解锁微信小程序项目源码
  14. @Qualifier的作用和应用
  15. 云计算和web服务器应用,基于云计算的Web服务选择及应用研究
  16. python的eval函数
  17. vuepress博客主题—vuepress-theme-reco
  18. 深入了解物联网,这几个物联网技术了解吗?
  19. 蚂蚁森林在沙漠种植了5552万棵树,原来我也在做一件改变世界
  20. 结构光学习 | 波前重构技术

热门文章

  1. python k线顶分型_K线战法之『顶底分型』高手懂的!
  2. 有关ajaxpro中的AjaxMethod
  3. 马凯军 周强 张季跃《面向对象与程序设计 Java》第十四周学习总结
  4. 安装 部署 postgresql数据库 搭建主从节点 (业务库)
  5. 2020本科校招-从小白到拿到30k offer的学习经历
  6. 买房付尾款要注意的细节
  7. 12:Integer to Roman(数字转为罗马数字)
  8. ZCuSn10Pb1铸造锡青铜套ZCuSn10Pb1力学性能
  9. MATLAB多个for循环嵌套的执行顺序、如何将生成的数据存放在一个向量或矩阵里?
  10. 回音壁与电视扬声器那些不得不说的事