python、R语言ARIMA-GARCH分析南方恒生中国企业ETF基金净值时间序列分析

2024-04-30 64

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： python、R语言ARIMA-GARCH分析南方恒生中国企业ETF基金净值时间序列分析

全文链接：https://tecdat.cn/?p=34123

分析师：Yuyan Wang

虽然中国股票市场日益完善,但还不完全是弱有效市场,因此中国股票市场存在比较明显的通过技术分析达到的套利机会（点击文末“阅读原文”了解更多）。

解决方案

任务/目标

根据基金净值的要求，帮助客户运用多种模型分析实现股票走势的预测。

数据源准备

本次数据来源于天天基金网南方恒生中国企业ETF版面，数据获取采用python（版本3.6）爬虫，数据分析部分则是采用Rstudio（3.6.2）。由于南方恒生中国企业ETF没有分红，所以单位净值和累计净值相同，本次分析采用单位净值（数据采用从2018/2/8~2020/6/10，共556个）作为数据分析对象。本次数据分析采用的数据模型有AR, MA,ARMA,GARCH模型。

数据预处理

将获得数据进行标准化，并作图发现数据超出了[0,1]的限制，于是我们可以初步估计数据不满足正态性。其次，我们采取箱形图法分析分析数据中可能存在的异常值，发现数据中存在三个异常值点，2020-03-18 -3.636842，2020-03-19 -4.182578，2020-03-23 -3.552882。

数据波动性大且不聚集。于是对数据进行二阶差分（一次差分模型拟合效果不好）。利用箱型图法进行异常值检测，发现二阶差分之后的数据异常值增多，但是从图上可以看出数据具有集群波动性，在这里初步估计数据具有garch模型的特点。

构造

首先考察时间序列时间序列平方以及绝对值的ACF和PACF图，判断二阶差分具有一定的ARCH性质，接下来我们使用MC.LEOAD.LI方法检验我们刚才的判断。右图说明，二阶差分数据具有很强的ARCH特征。现在我们计算其峰度以及偏度，判断其厚尾性。偏度为0.2112377，峰度为2.870266，j-b检验数为171.9739 远大于kai(2)的置信度5% 时的3.84, 因此相信序列存在高阶相关性和厚尾结构。