数学建模论文-中国GDP增长的数学模型及其分析与预测(2)
2
若r ra,则x与y有显著的线性关系;若r ra,则x与y的线性相关关系不显著
4、回归系数显著性检验
回归系数的显著性检验可用t检验法进行,令
tb1
b1
(1-7) Sb1
tb1 t(n 2),
其中
Sb1
取显著性水平 (Pt ta) ),若tb1 ta,则回归系数b1显著,此检验对常数项亦适用。
5、F检验
统计量
F
) (y
i
i 1i
n
2
) (y y
i
i 1
n
(1-8)
2
n 2)
服从F(1,n 2)分布,取显著性水平 .若F F,则表明回归模型显著;( 1,n-2)如果F F (1,n 2),则表明回归模型不显著,改回归模型不能用于预测。 6、DW统计量
DW统计量是用来检验回归模型的剩余项 i之间是否存在自相关的一种十分有效的
方法。
DW
(
i 2
n
2
)ii 1
i 1
n
(1-9)
2i
i 式中 i yi y
将利用式(1-9)计算而得到的DW值与不同显著性水平 下的DW值之上限d 和下限进行比较,来确定是否存在自相关。DW值应在0 4之间。
当DW值小于或等于2时,DW检验法则规定: 如果DW dl,则认为 i存在正自相关;
如果DW d ,则认为 i无自相关;
如果dl DW d ,则不能确定 i是否有自相关。
当DW值大于2时,DW检验法则规定: 如果4 DW dl,则认为 i存在负自相关; 如果4 DW d ,则认为 i无自相关;
如果dl 4 DW d ,则不能确定 i是否有自相关
根据经验,DW统计量的值在1.5 2.5之间时表示没有显著自相关问题。 以上检验可利用统计软件包进行回归时同时完成
Step4、进行预测
预测可分为点预测和区间预测两类,在一元线性回归中,所谓点预测,就是当给定
x x0时,利用样本回归方程求出相应的样本拟合值y0 b0 b1x0,以此作为因变量个别
值y0和其均值E(y0)的估计。
区间预测是给出一个在一定概率保证程度下的预测置信区间。
进行区间预测,首先要进行点预测,确定x0的值,求得y0的预测值y0。 y0的置信度为100(1 )%的预测区间的端点为:
y0 t Sc0 (1-10)
其中,S为标准偏差,t0可由t分布表查得,其自由度为n 2,满足P(t t ) ,而
1
c0
n
x x x x
2
0n
i
i 1
2
ARIMA模型建模步骤
数据平稳化处理[2]
首先要对时间序列数据进行平稳性检验。可以通过时间序列的散点图或折线图对序列进行初步的平稳性判断。一般采用ADF单位根检验来精确判断该序列的平稳性。对非平稳的时间序列,我们可以先对数据进行取对数或进行差分处理,然后判断经处理后序列的平稳性。重复以上过程,直至成为平稳序列。此时差分的次数即为 ARIMA p,d,q 模型中的阶数
d。从理论上而言,足够多次的差分运算可以充分地提取序列中的非平稳确定性信息。但应
当注意的是,差分运算的阶数并不是越多越好。因为差分运算是一种对信息的提取、加工过程,每次差分都会有信息的损失,所以在实际应用中差分运算的阶数要适当,应当避免过度差分,简称过差分的现象。一般差分次数不超过2次。
数据平稳化处理后,ARIMA p,d,q 模型即转化为ARMA p,q 模型。
模型识别
我们引入自相关系数和偏自相关系数这两个统计量来识别ARMA p,q 模型的系数特点和模型的阶数。若平稳序列的偏相关函数是截尾的,而自相关函数是拖尾的,可断定序列适合AR模型;若平稳序列的偏相关函数是拖尾的,而自相关函数是截尾的,则可断定序列适合MA模型;若平稳序列的偏相关函数和自相关函数均是拖尾的,则序列适合ARMA模型。自相关函数成周期规律的序列,可选用季节性乘积模型。自相关函数规律复杂的序列,可能需要作非线性模型拟合。
在平稳时间序列自相关函数和偏自相关函数上初步识别ARMA模型阶数p和q,然后利用AIC定则准确定阶。AIC准则:最小信息准则,同时给出ARMA模型阶数和参数的最佳估计,适用于样本数据较少的问题。目的是判断预测目标的发展过程与哪一随机过程最为接近。因为只有当样本量足够大时,样本的自相关函数才非常接近母体的自相关函数。具体运用时,在规定范围内使模型阶数从低到高,分别计算AIC值,最后确定使其值最小的阶数是模型的合适阶数。关于ARMA p,q 模型,AIC函数定义如下:
[3]
AIC nlog 2 2 p q
式中:n平稳序列为样本数, 为拟合残差平方和,p,q为参数。 AIC准则定阶方法可写为:
2
AIC p,q minAIC k,l
k,l
0 k M,0 l H
其中:M,N为ARMA模型阶数的上限值,一般取为根号n或n/10。实际应用中p,
q一般不超过2。 参数估计
确定模型阶数后,应对ARMA模型进行参数估计。本文采用最小二乘法OLS进行参数估计,需要注意的是,MA模型的参数估计相对困难,应尽量避免使用高阶的移动平均模型或包含高阶移动平均项的ARMA模型。
模型检验[4]
完成模型的识别与参数估计后,应对估计结果进行诊断与检验,以求发现所选用的模型是否合适。若不合适,应该知道下一步作何种修改。这一阶段主要检验拟合的模型是否合理。一是检验模型参数的估计值是否具有显著性;二是检验模型的残差序列是否为白噪声。参数估计值的显著性检验是通过t检验完成的Q检验的零假设是H0: 1 2 k即模型
的误差项是一个白噪声过程。Q 近似服从
2
统计量定义为Q T T 2
k p q 分布,其中T表示样本容量,rk表示用残差序列计算的自相
关系数值,k表示自相关系数的个数,p表示模型自回归部分的最大滞后值,q表示移动平均部分的最大滞后值。用残差序列计算Q统计量的值。显然若残差序列不是白噪声,残差序列中必含有其他成份,自相关系数不等于零。则Q值将很大,反之Q值将很小。判别规则是:
若Q k p q ,则接受H0。
2
若Q k p q ,则拒绝H0。
2
其中 表示检验水平。
模型求解
回归分析模型的模型求解
从图1中我们大致可以确定该图与幂函数多项式的图象较为相近,所以我们建立了多
项式模型,运用matlab计算得到表二
根据多项式模型的检验方法,二次,三次及四次多项式大部分指标差别不大,拟合效果比较差,从五次到七次多项式拟合效果越来越好,到八次多项式F值突然减小,造成拟合效果下降,于是本文选择了七次多项式来拟合。
利用matlab统计工具求解,得到回归系数估计值及置信区间(置信水平 =0.05)见
表三
于是得到回归方程
234
15706 y.3967 16126.7508x 6564.1066x 1124.7878x 95.8665x
4.1564x 0.0880x 0.0007x (其中x表示具体年度减去1977) 绘图如图3
567
5
图3 GDP随时间变化曲线
GDP总量
51015
时间
20253035
由图3,我们可以进一步确定拟合效果非常好。
根据所求得的函数关系式,我们对未来10年对相关书籍的产量进行了预测,预测结果见表四所示:
表四 GDP预测值
ARIMA模型求解
通过计算自相关函数和偏相关函数,确定取d=2。利用AIC准则对表五定阶,取ARIMA(1,2,2)模型。计算得
< …… 此处隐藏:3149字,全部文档内容请下载后查看。喜欢就下载吧 ……相关推荐:
- [小学教育]四年级综合实践活动课《衣物的洗涤》教
- [小学教育]2014半年工作总结怎么写
- [小学教育]20世纪外国文学专题综合试题及答案
- [小学教育]TS_1循环使用催化丙烯环氧化反应研究
- [小学教育]最实用的考勤签到表(上下班签到表)
- [小学教育]气候与生态建筑——以新疆民居为例
- [小学教育]二人以上股东有限责任公司章程参考样本
- [小学教育]2014届第一轮复习资料4.1,3美好生活的
- [小学教育]土方开挖、降水方案
- [小学教育]手绘儿童绘本《秋天的图画》(蜡笔)
- [小学教育]2002级硕士研究生卫生统计学考试试题
- [小学教育]环保装备重点发展目录
- [小学教育]金蝶K3合并报表培训教材
- [小学教育]岩浆岩试题及参考答案
- [小学教育]知之深爱之切学习心得
- [小学教育]第十二章 蛋白质的生物合成
- [小学教育]Chapter 2-3 Solid structure and basi
- [小学教育]市政道路雨季专项施工方案
- [小学教育]中国海洋大学2012-2013学年第二学期天
- [小学教育]教育心理学第3章-学习迁移
- 浅谈深化国企改革中加强党管企业
- 2006年中国病理生理学会学术活动安排
- 设计投标工作大纲
- 基于ARP的网络攻击与防御
- 2016届湖北省七市(州)教科研协作体高三
- Google_学术搜索及其检索技巧
- 2019-2020学年七年级地理下册6.3美洲教
- 城市道路可研报告
- 【名师指津】2012高考英语 写作基础技
- 6级知识点培训北京师范大学《幼儿智趣
- 注册会计师会计知识点:金融资产
- 新安装 500 kV 变压器介损分析与判断
- PS2模拟器PCSX2设置及使用教程.
- 医院药事管理与药剂科管理组织机构
- {PPT背景素材}丹巴的醉人美景,免费,一
- NAS网络存储应用解决方案
- 青海省西宁市六年级上学期数学期末考试
- 测量管理体系手册依据ISO10012:2003
- 洞子小学培养骨干教师工作计划
- 浅谈《牛津初中英语》的教材特点及教学




