数据分享|R语言ARIMA模型分析预测上海空气质量指数AQI时间序列

简介: 数据分享|R语言ARIMA模型分析预测上海空气质量指数AQI时间序列

全文链接:http://tecdat.cn/?p=32265


指数平滑法对于预测来说是非常有帮助的,而且它对时间序列上面连续的值之间相关性没有要求点击文末“阅读原文”获取完整代码数据


但是,如果你想使用指数平滑法计算出预测区间,那么预测误差必须是不相关的, 而且必须是服从零均值、 方差不变的正态分布。即使指数平滑法对时间序列连续数值之间相关性没有要求,在某种情况下,我们可以通过考虑数据之间的相关性来创建更好的预测模型。

自回归移动平均模型( ARIMA) 包含一个确定(explicit)的统计模型用于处理时间序列的不规则部分,它也允许不规则部分可以自相关。

我们以上海空气质量指数AQI做成的时间序列数据查看文末了解数据免费获取方式为例。随着时间增加, 数值变化很大。

下面是excel数据:

data=read.xlsx("上海空气质量指数 (1).xlsx")  
head(data)
##     城市  日期 AQI指数  
## 1 上海市 41640     193  
## 2 上海市 41641     140  
## 3 上海市 41642     195  
## 4 上海市 41643     137  
## 5 上海市 41644      83  
## 6 上海市 41645      59

把数据转换成时间序列格式。

data=ts(data[,3],start = c(2014,1,1) ,frequency = 365)


查看数据概览


summary(data)
##    Min. 1st Qu.  Median    Mean 3rd Qu.    Max.  
##    28.0    59.0    77.0    86.5   103.0   266.0

点击标题查阅往期内容


python用ARIMA模型预测CO2浓度时间序列实现


01

 

02

03

04


平稳性检验(ADF单位根检验)

adf.test(data,k = 5)
##  Augmented Dickey-Fuller Test  
##  
## data:  data  
## Dickey-Fuller = -9.987, Lag order = 5, p-value = 0.01  
## alternative hypothesis: stationary


验出P值小于0.05,不存在单位根,说明原时间序列稳定。


找到合适的ARIMA模型


如果你的时间序列是平稳的,或者你通过做 n 次差分转化为一个平稳时间序列, 接下来就是要选择合适的 ARIMA模型,这意味着需要寻找 ARIMA(p,d,q)中合适的 p 值和 q 值。为了得到这些,通常需要检查[平稳时间序列的(自)相关图和偏相关图。

观察 ARIMA 模型的预测误差是否是平均值为 0 且方差为常数的正态分布(服从零均值、方差不变的正态分布) 是个好主意,同时也要观察连续预测误差是否(自)相关。

#AR(1)

model=arima(data,c(1,0,0))


AIC


model$aic
## [1] 8421.217


找到最小的AIC值


which.min(c(model$aic,model2$aic,model3$aic,model4$aic,model5$aic,model6$aic))
## [1] 5

所以最小的AIC是模型5,因此将模型5作为最优的模型来建模。

## Coefficients:
## Warning in sqrt(diag(x$var.coef)): 产生了NaNs
##          ar1      ar2     ar3      ma1     ma2  intercept  
##       1.4415  -1.3018  0.3937  -0.9435  0.7885    86.8142


评估误差


#MAE  
mean(abs(model5$residuals))
## [1] 24.5714
#RMSE  
mean(sqrt(abs(model5$residuals)))
## [1] 4.496127


预测未来的变化趋势


pred=ts(pre$pred,start = c(2016,5,1),frequency =365)

####绘制预测数据  
points(pre$pred,


相关文章
|
6月前
【R语言实战】——带有高斯新息的金融时序的GARCH模型拟合预测及VAR/ES风险度量
【R语言实战】——带有高斯新息的金融时序的GARCH模型拟合预测及VAR/ES风险度量
|
6月前
【R语言实战】——带有新息为标准学生t分布的金融时序的GARCH模型拟合预测
【R语言实战】——带有新息为标准学生t分布的金融时序的GARCH模型拟合预测
|
2月前
|
机器学习/深度学习 算法 前端开发
R语言基础机器学习模型:深入探索决策树与随机森林
【9月更文挑战第2天】决策树和随机森林作为R语言中基础且强大的机器学习模型,各有其独特的优势和适用范围。了解并熟练掌握这两种模型,对于数据科学家和机器学习爱好者来说,无疑是一个重要的里程碑。希望本文能够帮助您更好地理解这两种模型,并在实际项目中灵活应用。
|
3月前
|
数据采集 存储 数据可视化
R语言时间序列分析:处理与建模时间序列数据的深度探索
【8月更文挑战第31天】R语言作为一款功能强大的数据分析工具,为处理时间序列数据提供了丰富的函数和包。从数据读取、预处理、建模到可视化,R语言都提供了灵活且强大的解决方案。然而,时间序列数据的处理和分析是一个复杂的过程,需要结合具体的应用场景和需求来选择合适的方法和模型。希望本文能为读者在R语言中进行时间序列分析提供一些有益的参考和启示。
|
3月前
|
资源调度 数据挖掘
R语言回归分析:线性回归模型的构建与评估
【8月更文挑战第31天】线性回归模型是统计分析中一种重要且实用的工具,能够帮助我们理解和预测自变量与因变量之间的线性关系。在R语言中,我们可以轻松地构建和评估线性回归模型,从而对数据背后的关系进行深入的探索和分析。
|
6月前
|
数据可视化
【R语言实战】——金融时序ARIMA建模
【R语言实战】——金融时序ARIMA建模
|
6月前
【R语言实战】——Logistic回归模型
【R语言实战】——Logistic回归模型
|
6月前
|
数据可视化
R语言广义线性混合模型GLMMs在生态学中应用可视化2实例合集|附数据代码2
R语言广义线性混合模型GLMMs在生态学中应用可视化2实例合集|附数据代码
|
6月前
|
数据可视化 数据挖掘
R语言广义线性混合模型GLMMs在生态学中应用可视化2实例合集|附数据代码1
R语言广义线性混合模型GLMMs在生态学中应用可视化2实例合集|附数据代码
|
6月前
|
机器学习/深度学习 数据可视化
R语言Stan贝叶斯回归置信区间后验分布可视化模型检验|附数据代码
R语言Stan贝叶斯回归置信区间后验分布可视化模型检验|附数据代码
下一篇
无影云桌面