搜档网
当前位置:搜档网 › 计量经济学多元线性回归、多重共线性、异方差实验报告记录

计量经济学多元线性回归、多重共线性、异方差实验报告记录

计量经济学多元线性回归、多重共线性、异方差实验报告记录
计量经济学多元线性回归、多重共线性、异方差实验报告记录

计量经济学多元线性回归、多重共线性、异方差实验报告记录

————————————————————————————————作者:————————————————————————————————日期:

计量经济学实验报告

多元线性回归、多重共线性、异方差实验报告

一、研究目的和要求:

随着经济的发展,人们生活水平的提高,旅游业已经成为中国社会新的经济增长点。旅游产业是一个关联性很强的综合产业,一次完整的旅游活动包括吃、住、行、游、购、娱六大要素,旅游产业的发展可以直接或者间接推动第三产业、第二产业和第一产业的发展。尤其是假日旅游,有力刺激了居民消费而拉动内需。2012年,我国全年国内旅游人数达到亿人次,同比增长%,国内旅游收入万亿元,同比增长%。旅游业的发展不仅对增加就业和扩大内需起到重要的推动作用,优化产业结构,而且可以增加国家外汇收入,促进国际收支平衡,加强国家、地区间的文化交流。为了研究影响旅游景区收入增长的主要原因,分析旅游收入增长规律,需要建立计量经济模型。

影响旅游业发展的因素很多,但据分析主要因素可能有国内和国际两个方面,因此在进行旅游景区收入分析模型设定时,引入城镇居民可支配收入和旅游外汇收入为解释变量。旅游业很大程度上受其产业本身的发展水平和从业人数影响,固定资产和从业人数体现了旅游产业发展规模的内在影响因素,因此引入旅游景区固定资产和旅游业从业人数作为解释变量。因此选取我国31个省市地区的旅游业相关数据进行定量分析我国旅游业发展的影响因素。

二、模型设定

根据以上的分析,建立以下模型

Y=β

0+β

1

X

1

2

X

2

3

X

3

4

X

4

+Ut

参数说明:

Y ——旅游景区营业收入/万元

X

1

——旅游业从业人员/人

X

2

——旅游景区固定资产/万元

X

3

——旅游外汇收入/万美元

X

4

——城镇居民可支配收入/元

收集到的数据如下(见表):

表 2011年全国旅游景区营业收入及相关数据(按地区分)

地区营业收入从业人数固定资产外汇收入可支配收入

北京145466541600

天津24787175553

河北7964344765

山西5771956719

内蒙古3626467097

辽宁64816271314

吉林2906638528

黑龙江3034191762

上海91106575118

江苏140154565297

浙江132459454173

安徽55840117918

福建80303363444

江西4179141500

山东143026255076

河南7016454903

湖北6276794018

湖南80615101434

广东2265391390619

广西49876105188

海南3075937615

重庆5016096806

四川7075659383

贵州2768313507

云南62679160861

西藏602312963

陕西57077129505

甘肃312801740

青海87412659

宁夏12196620

新疆4045146519

数据来源:1.中国统计年鉴2012,

2.中国旅游年鉴2012。

三、参数估计

利用做多元线性回归分析步骤如下:

1、创建工作文件

双击图标,进入其主页。在主菜单中依次点击“File\New\Workfile”,出现对话框“Workfile Range”。本例中是截面数据,在workfile structure type中选择“Unstructured/Undated”,在Date range中填入observations 31,点击ok键,完成工作文件的创建。

2、输入数据

在命令框中输入 data Y X1 X2 X3 X4,回车出现“Group”窗口数据编辑框,在对应的Y X1 X2 X3 X4下输入相应数据,关闭对话框将其命名为group01,点击ok,保存。

对数据进行存盘,点击“File/Save As”,出现“Save As”对话框,选择存入路径,并将文件命名,再点“ok”。

3、参数估计

在命令框中键入“LS Y C X1 X2 X3 X4”,按回车键,即出现回归结果。

利用估计模型参数,最小二乘法的回归结果如下:

表回归结果

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:14

Sample: 1 31

Included observations: 31

Coefficien

t Std. Error t-Statistic Prob.

C

X1

X2

X3

X4

R-squared Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid+10Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic Durbin-Watson stat Prob(F-statistic)

根据表中的样本数据,模型估计结果为

^

Y=+

1+

2

+

34

()()()()() t =

R2=

-

-

R2= F= DW=

可以看出,可决系数R2=,修正的可决系数

-

-

R2=。说明模型的拟合程度还可

以。但是当α=时,X

1、 X

2

、X

4

系数均不能通过检验,且X

4

的系数为负,与经

济意义不符,表明模型很可能存在严重的多重共线性。

四、模型修正

1.多重共线性的检验与修正

(1)检验

选中X1 X2 X3 X4数据,点击右键,选择“Open/as Group”,在出现的对话框中选择“View/Covariance Analysis/correlation”,点击ok,得到相关系数矩阵。

计算各个解释变量的相关系数,得到相关系数矩阵。

表相关系数矩阵

变量X1X2X3X4

X1

X2

X3

X4

由相关系数矩阵可以看出,解释变量X2、X3之间存在较高的相关系数,证实确实存在严重的多重共线性。

(2)多重共线性修正

采用逐步回归的办法,检验和回归多重共线性问题。分别作Y对X1、X2、

X3、X4的一元回归,在命令窗口分别输入LS Y C X1,LS Y C X2,LS Y C X3,LS Y C X4,并保存,整理结果如表所示。

表一元回归结果

变量X1X2X3X4参数估计值

t统计量

R2

-

2

R

其中,X2的方程

-

2

R最大,以X2为基础,顺次加入其它变量逐步回归。在命令窗口中

依次输入:LS Y C X2 X1,LS Y C X2 X3, LS Y C X2 X4,并保存结果,整理结果如表所示。

表加入新变量的回归结果(一)

变量变量X1X2X3X4-2

R

X2,X1

X2,X3

X2,X4()

经比较,新加入X1的方程

-

2

R=,改进最大,而且各个参数的t检验显著,选择保留X1,

再加入其它新变量逐步回归,在命令框中依次输入:LS Y C X2 X1 X3,LS Y C X2 X1 X4,保存结果,整理结果如表所示。

表加入新变量的回归结果(二)

变量变量X1X2X3X4-2

R

X2,X1,X3 X2,X1,X4

当加入X3或X4时,

-

2

R均没有所增加,且其参数是t检验不显著。从相关系数可以看

出X3、X4与X1、X2之间相关系数较高,这说明X3、X4引起了多重共线性,予以剔除。

当取α=时,t

α/2

(n-k-1)=,X1、X2的系数t检验均显著,这是最后消除多

重共线性的结果。

修正多重共线性影响后的模型为

^

Y= X

1+ X

2

()()t =

R2=

2

R=0.866053 F= DW=

在确定模型以后,进行参数估计

表消除多重共线性后的回归结果

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:47

Sample: 1 31

Included observations: 31

Coefficie

nt Std. Error t-Statistic Prob.

C

X1

X2

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid+10

Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

五、异方差检验

在实际的经济问题中经常会出现异方差这种现象,因此建立模型时,必须要注意异方差的检验,否则,在实际中会失去意义。

(1)检验异方差

由表的结果,按路径“View/Residual Tests/Heteroskedasticity Tests”,在出现的对话框中选择Specification:White,点击ok.得到White检验结果如下。

表 White检验结果

Heteroskedasticity Test: White

F-statistic Prob. F(5,25)

Obs*R-squared

Prob. Chi-Square(5)

Scaled explained SS

Prob. Chi-Square(5)

Test Equation:

Dependent Variable: RESID^2

Method: Least Squares

Date: 11/14/13 Time: 21:48

Sample: 1 31

Included observations: 31

Coefficie

nt Std. Error t-Statistic Prob.

C+09+09

X1

X1^2

X1*X2

X2

X2^2

R-squared

Mean dependent

var+09

Adjusted R-squared. dependent var+09

. of regression+09

Akaike info criterion

Sum squared resid+20

Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

从上表可以看出,nR2=,由White检验可知,在α=下,查2χ分布表,得

临界值χ2

05

.0 (5)=,比较计算的2χ统计量与临界值,因为nR2=>χ2

05

.0

(5)=,所

以拒绝原假设,表明模型存在异方差。

(2)异方差的修正

①用WLS估计:选择权重w=1/e1^2,其中e1=resid。

在命令窗口中输入 genr e1= resid,点回车键。

在消除多重共线性后的回归结果(表的回归结果)对话框中点击

Estimate/Options/Weithted LS/TSLS,并在Weight中输入1/e1^2,点确定,得到如下回归结果。

表用权数1/e1^2的回归结果

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:49

Sample: 1 31

Included observations: 31

Weighting series: 1/E1^2

Coefficie

nt Std. Error t-Statistic Prob.

C

X1

X2

Weighted Statistics

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid

Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

Unweighted Statistics

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Sum squared

resid+10

Durbin-Watson stat

②修正后的White检验为

在表的回归结果中,按路径“View/Residual Tests/Heteroskedasticity Tests”,在出现的对话框中选择Specification:White,点击ok.得到White 检验结果如下。

表修正后的White 检验结果

Heteroskedasticity Test: White

F-statistic Prob. F(2,28)

Obs*R-squared

Prob. Chi-Square(2)

Scaled explained SS

Prob. Chi-Square(2)

Test Equation:

Dependent Variable: WGT_RESID^2

Method: Least Squares

Date: 11/15/13 Time: 20:29

Sample: 1 31

Included observations: 31

Collinear test regressors dropped from specification

Coefficie

nt Std. Error t-Statistic Prob.

C

WGT

WGT^2

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid

Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

从上表可知nR2==<χ2

05

.0

(5)=,证明模型中的异方差已经被消除了。异方差修正后的模型为

^

Y= +*+ X2*

t = ( (

R2=

2

R=0.999837 F= DW=

其中X

1*= 1/e1^2* X

1

, X

2

*=1/e1^2*X

2

, e1=resid。

六、自相关检验与修正

(1)DW检验

在显著性水平α=,查DW表,当n=31,k=2时,得上临界值d

u

=,下临界

值d

l =,DW= 。因为d

u

u

,所以模型不存在序列自相关。

由图示法也可以看出随机误差项μ

i

不存在自相关。下图是残差及一阶滞后残差相关图。

图残差与其滞后一阶残差图

(2)LM检验

在表的回归结果中,按路径“View/Residual Tests/Serial Correlation LM Tests”,在出现的对话框中选择Lags to include:1,点击ok.得到LM检验结果如下。

表 LM检验结果

Breusch-Godfrey Serial Correlation LM Test:

F-statistic Prob. F(1,27)

Obs*R-squared

Prob. Chi-Square(1)

Test Equation:

Dependent Variable: RESID

Method: Least Squares

Date: 11/14/13 Time: 21:50

Sample: 1 31

Included observations: 31

Presample missing value lagged residuals set to zero. Weight series: 1/E1^2

Coefficie

nt Std. Error t-Statistic Prob.

C

X1

X2

RESID(-1)

Weighted Statistics

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid

Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

Unweighted Statistics

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Sum squared

resid+10

Durbin-Watson stat

从上表可以看出,nR2=,由LM检验可知,在α=下,查2χ分布表,得临界

值χ2

05

.0 (5)=,比较计算的2χ统计量与临界值,因为nR2=<χ2

05

.0

(5)=,所以接

受原假设,表明模型不存在自相关。

七、模型检验

1、经济意义检验

模型估计结果表明,在假定其他变量不变的情况下,当景区固定资产每增长1元时,旅游收入增加元;在假定其他变量不变的情况下,当景区从业人员每增加1人时,旅游收入增加万元。这与理论分析判断相一致。

2、统计检验

(1)拟合优度:由表中数据可得:R2=,修正的可决系数为

-

2

R=,这说明

模型对样本的拟合很好。

(2)F检验:针对H0:β1=β2=0,给定显著性水平α=,在F分布表中查出

自由度为k=2和n-k-1=28的临界值F

α( 2,28)=。由表中得到F=,由于F=> F

α

( 2,

28)=,应拒绝原假设,说明回归方程显著,即“旅游景区固定资产”、“旅游从业人员”等变量联合起来确实对“旅游景区营业收入”有显著影响。

(3)t检验:分别对H0:βj=0(j=1,2),给定显著性水平α=,查t分布表

得自由度为n-k-1=28临界值t

α/2(n-k-1)=。由表中数据可得,

^

1

β、^

2

β对应的t

统计量分别为、,其绝对值均大于t

α/2

(n-k-1)=,这说明应该分别拒绝H0:βj =0(j=1,2),也就是说,当在其他解释变量不变的情况下,解释变量“旅游景区固定资产”(X1)、“旅游从业人数”(X2)分别对被解释变量“旅游景区营业收入”(Y)影响显著。

八、附录

以下是多重共线性参数估计

备表1 对X

1

回归分析

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:14

Sample: 1 31

Included observations: 31

Coefficie

nt Std. Error t-Statistic Prob.

C

X1

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid+11Schwarz

criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

备表2 对X

2

回归分析

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:15

Sample: 1 31

Included observations: 31

Coefficie

nt Std. Error t-Statistic Prob.

C

X2

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid+10

Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

备表3 对X

3

回归分析

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:15

Sample: 1 31

Included observations: 31

Coefficie

nt Std. Error t-Statistic Prob.

C

X3

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid+11

Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

备表4 对X

4

回归分析

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:15

Sample: 1 31

Included observations: 31

Coefficie

nt Std. Error t-Statistic Prob.

C

X4

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid+11

Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

备表5 对X

2、X

1

回归分析

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:15

Sample: 1 31

Included observations: 31

Coefficie

nt Std. Error t-Statistic Prob.

C

X2

X1

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid+10

Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

备表6 对X

2、X

3

回归分析

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:15

Sample: 1 31

Included observations: 31

Coefficie

nt Std. Error t-Statistic Prob.

C

X2

X3

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid+10Schwarz

criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

备表7 对X

2、X

4

回归分析

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:15

Sample: 1 31

Included observations: 31

Coefficie

nt Std. Error t-Statistic Prob.

C

X2

X4

R-squared

Mean dependent var

Adjusted R-squared. dependent var

. of regression

Akaike info criterion

Sum squared resid+10

Schwarz criterion

Log likelihood

Hannan-Quinn criter.

F-statistic

Durbin-Watson stat

Prob(F-statistic)

备表8 对X

2、X

1

、X

3

回归分析

Dependent Variable: Y

Method: Least Squares

Date: 11/14/13 Time: 21:15

Sample: 1 31

Included observations: 31

Coefficie

nt Std. Error t-Statistic Prob.

SPSS实验报告_线性回归_曲线估计

《数据分析实务与案例实验报告》 曲线估计 学号:2013111104000614 班级:2013 应用统计 姓名: 日期: 2 0 1 4 – 12 – 7 数学与统计学学院

一、实验目的 1. 准确理解曲线回归分析的方法原理。 2. 了解如何将本质线性关系模型转化为线性关系模型进行回归分析。 3. 熟练掌握曲线估计的SPSS 操作。 4. 掌握建立合适曲线模型的判断依据。 5. 掌握如何利用曲线回归方程进行预测。 6. 培养运用多曲线估计解决身边实际问题的能力。 二、准备知识 1. 非线性模型的基本内容 变量之间的非线性关系可以划分为 本质线性关系和本质非线性关系。所谓本质线性关系是指变量关系形式上虽然呈非线性关系,但可以通过变量转化为线性关系,并可最终进行线性回归分析,建立线性模型。本质非线性关系是指变量之间不仅形式上呈现非线性关系,而且也无法通过变量转化为线性关系,最终无法进行线性回归分析,建立线性模型。本实验针对本质线性模型进行。 下面介绍本次实验涉及到的可线性化的非线性模型,所用的变换既有自变量的变换,也有因变量的变换。 乘法模型: 123y x x x βγδαε= 其中α,β,γ,δ 都是未知参数,ε是乘积随机误差。对上式两边取自然对数得到 123ln ln ln ln ln ln y x x x αβγδε=++++

上式具有一般线性回归方程的形式,因而用多元线性回归的方法来处理。然而,必须强调指出的是,在求置信区间和做有关试验时,必须是2ln (0,)n N I εδ: , 而不是2n N I εδ:(0,) ,因此检验之前,要先检验ln ε 是否满足这个假设。 三、实验内容 已有很多学者验证了能源消费与经济增长的因果关系,证明了能源消费是促进经济增长的原因之一。也有众多学者利用C-D 生产函数验证了劳动和资本对经济增长的影响机理。所有这些研究都极少将劳动、资本、和能源建立在一个模型中来研究三个因素对经济增长的作用方向和作用大小。 现从我国能源消费、全社会固定资产投资和就业人员的实际出发,假定生产技术水平在短期能不会发生较大变化,经济增长、全社会固定资产投资、就业人员、能源消费可以分别采用国内生产总值、全社会固定资产投资总量、就业总人数、能源消费总量进行衡量,并假定经济增长与能源消费、资本和劳动力的关系均满足C-D 生产函数。 问题中的C-D 生产函数为: Y AK L E αβγ= 式中:Y 为GDP ,衡量总产出;K 为全社会固定资产投资,衡量资本投入量;L 为就业人数,衡量劳动投入量;E 为能源消费总量,衡量能源投入量;A,α,β, γ 为未知参数。根据C-D 函数的假定,一般情形α,β,γ均在0和1之间,但当α,β,γ中有负数时,说明这种投入量的增长,反而会引起GDP 的下降,当α,β,γ中出现大于1的值时,说明这种投入量的增加会引起GDP 成倍增加,这在经济学现象中都是存在的。 以我国1985—2004年的有关数据建立了SPSS 数据集,参见

多元线性回归SPSS实验报告

回归分析基本分析: 将毕业生人数移入因变量,其他解释变量移入自变量。在统计量中选择估计和模型拟合度,得到如图 注解:模型的拟合优度检验:

第二列:两变量(被解释变量和解释变量)的复相关系数R=0.999。 第三列:被解释向量(毕业人数)和解释向量的判定系数R2=0.998。 第四列:被解释向量(毕业人数)和解释向量的调整判定系数R2=0.971。在多个解释变量的时候,需要参考调整的判定系数,越接近1,说明回归方程对样本数据的拟合优度越高,被解释向量可以被模型解释的部分越多。 第五列:回归方程的估计标准误差=9.822 回归方程的显著性检验-回归分析的方差分析表 F检验统计量的值=776.216,对应的概率p值=0.000,小于显著性水平0.05,应拒绝回归方程显著性检验原假设(回归系数与0不存在显著性差异),认为:回归系数不为0,被解释变量(毕业生人数)和解释变量的线性关系显著,可以建立线性模型。 注解:回归系数的显著性检验以及回归方程的偏回归系数和常数项的估计值第二列:常数项估计值=-544.366;其余是偏回归系数估计值。

第三列:偏回归系数的标准误差。 第四列:标准化偏回归系数。 第五列:偏回归系数T检验的t统计量。 第六列:t统计量对应的概率p值;小于显著性水平0.05,拒接原假设(回归系数与0不存在显著性差异),认为回归系数部位0,被解释变量与解释变量的线性关系是显著的;大于显著性水平0.05,接受原假设(回归系数与0不存在显著性差异),认为回归系数为0被解释变量与解释变量的线性关系不显著的。 于是,多元线性回归方程为: y=-544.366+0.032x1+0.009x2+0.001x3-0.1x5+3.046x6 回归分析的进一步分析: 1.多重共线性检验 从容差和方差膨胀因子来看,在校学生数和教职工总数与其他解释变量的多重共线性很严重。在重新建模中可以考虑剔除该变量

用SPSS进行单因素方差分析报告和多重比较

SPSS——单因素方差分析 单因素方差分析 单因素方差分析也称作一维方差分析。它检验由单一因素影响的一个(或几个相互独立的)因变量由因素各水平分组的均值之间的差异是否具有统计意义。还可以对该因素的若干水平分组中哪一组与其他各组均值间具有显著性差异进行分析,即进行均值的多重比较。One-Way ANOVA过程要求因变量属于正态分布总体。如果因变量的分布明显的是非正态,不能使用该过程,而应该使用非参数分析过程。如果几个因变量之间彼此不独立,应该用Repeated Measure 过程。 [例子] 调查不同水稻品种百丛中稻纵卷叶螟幼虫的数量,数据如表1-1所示。 表1-1 不同水稻品种百丛中稻纵卷叶螟幼虫数

3 40 35 35 38 34 数据保存在“data1.sav”文件中,变量格式如图1-1。 图1-1 分析水稻品种对稻纵卷叶螟幼虫抗虫性是否存在显著性差异。 。 2)启动分析过程 点击主菜单“Analyze”项,在下拉菜单中点击“Compare Means”项,在右拉式菜单中点击“0ne-Way ANOVA”项,系统 打开单因素方差分析设置窗口如图1-2。 图1-2 单因素方差分析窗口

3)设置分析变量 因变量:选择一个或多个因子变量进入“Dependent List”框中。本例选择“幼虫”。 因素变量:选择一个因素变量进入“Factor”框中。本例选择“品种”。 4)设置多项式比较 单击“Contrasts”按钮,将打开如图1-3所示的对话框。该对话框用于设置均值的多项式比较。 图1-3 “Contrasts”对话框 定义多项式的步骤为: 均值的多项式比较是包括两个或更多个均值的比较。例如图1-3中显示的是要求计算“1.1×mean1-1×mean2”的值,检验的假设H0:第一组均值的1.

计量经济学多元线性回归、多重共线性、异方差实验报告记录

计量经济学多元线性回归、多重共线性、异方差实验报告记录

————————————————————————————————作者:————————————————————————————————日期:

计量经济学实验报告

多元线性回归、多重共线性、异方差实验报告 一、研究目的和要求: 随着经济的发展,人们生活水平的提高,旅游业已经成为中国社会新的经济增长点。旅游产业是一个关联性很强的综合产业,一次完整的旅游活动包括吃、住、行、游、购、娱六大要素,旅游产业的发展可以直接或者间接推动第三产业、第二产业和第一产业的发展。尤其是假日旅游,有力刺激了居民消费而拉动内需。2012年,我国全年国内旅游人数达到亿人次,同比增长%,国内旅游收入万亿元,同比增长%。旅游业的发展不仅对增加就业和扩大内需起到重要的推动作用,优化产业结构,而且可以增加国家外汇收入,促进国际收支平衡,加强国家、地区间的文化交流。为了研究影响旅游景区收入增长的主要原因,分析旅游收入增长规律,需要建立计量经济模型。 影响旅游业发展的因素很多,但据分析主要因素可能有国内和国际两个方面,因此在进行旅游景区收入分析模型设定时,引入城镇居民可支配收入和旅游外汇收入为解释变量。旅游业很大程度上受其产业本身的发展水平和从业人数影响,固定资产和从业人数体现了旅游产业发展规模的内在影响因素,因此引入旅游景区固定资产和旅游业从业人数作为解释变量。因此选取我国31个省市地区的旅游业相关数据进行定量分析我国旅游业发展的影响因素。 二、模型设定 根据以上的分析,建立以下模型 Y=β 0+β 1 X 1 +β 2 X 2 +β 3 X 3 +β 4 X 4 +Ut 参数说明: Y ——旅游景区营业收入/万元 X 1 ——旅游业从业人员/人 X 2 ——旅游景区固定资产/万元 X 3 ——旅游外汇收入/万美元 X 4 ——城镇居民可支配收入/元

计量经济学实验报告(多元线性回归 自相关 )

实验报告 课程名称计量经济学 实验项目名称多元线性回归自相关 异方差多重共线性班级与班级代码 08国际商务1班实验室名称(或课室)实验楼910 专业国际商务 任课教师刘照德 学号: 043 姓名:张柳文 实验日期: 2011 年 06 月 23日 广东商学院教务处制

姓名张柳文实验报告成绩 评语: 指导教师(签名) 年月日说明:指导教师评分后,实验报告交院(系)办公室保存。

计量经济学实验报告 实验项目:多元线性回归、自相关、异方差、多重共线性 实验目的:掌握多元线性回归模型、自相关模型、异方差模型、多重共线性模型的估计和检验方法和处理方法 实验要求:选择方程进行多元线性回归;熟悉图形法检验和掌握D-W 检验,理解广义差分法变换和掌握迭代法;掌握Park或 Glejser检验,理解同方差性变换; 实验原理:普通最小二乘法图形检验法 D-W检验广义差分变换加权最小二乘法 Park检验等 实验步骤: 首先:选择数据 为了研究影响中国税收收入增长的主要原因,选择国内生产总值(GDP)、财政支出(ED)、商品零售价格指数(RPI)做为解释变量,对税收收入(Y)做多元线性回归。从《中国统计年鉴》2011中收集1978—2009年各项影响因素的数据。如下表所示: 中国税收收入及相关数据

实验一:多元线性回归 1、将数据导入后,分别对三个解释变量与被解释变量做散点图,选择两个变量作为group打开,在数据表“group”中点击view/graph/scatter/simple scatter,出现数据的散点图,分别如下图所示: 从散点图看,变量间不一定呈现线性关系,可以试着作线性回归。 2、进行因果关系检验

用SPSS进行单因素方差分析和多重比较

方差分析 方差分析可以用来检验来多个均值之间差异的显著性,可以看成是两样本t检验的扩展。统计学原理中涉及的方差分析主要包括单因素方差分析、两因素无交互作用的方差分析和两因素有交互作用的方差分析三种情况。虽然Excel可以进行这三种类型的方差分析,但对数据有一些限制条件,例如不能有缺失值,在两因素方差分析中各个处理要有相等的重复次数等;功能上也有一些不足,例如不能进行多重比较。而在方差分析方面SPSS的功能特别强大,很多输出结果已经超出了统计学原理的范围。 用SPSS检验数据分布的正态性 方差分析需要以下三个假设条件:(1)、在各个总体中因变量都服从正态分布;(2)、在各个总体中因变量的方差都相等;(3)、各个观测值之间是相互独立的。 在SPSS中我们很方便地对前两个条件进行假设检验。同方差性检验一般与方差分析一起进行,这一小节我们只讨论正态性的检验问题。 [例7.4] 检验生兴趣对考试成绩的影响的例子中各组数据的正态性。 在SPSS中输入数据(或打开数据文件),选择Analyze→Descriptive Statistics→Explore,在Explore对话框中将统计成绩作为因变量,兴趣作为分类变量(Fator),单击Plots按钮,选中“Histogram”复选框和“Normality plots with Test”,单击“Continue”按钮,在单击主对话框中的“OK”,可以得到分类别的描述统计信息。从数据的茎叶图、直方图和箱线图都可以对数据分布的正态性做出判断,由于这些内容前面已经做过讲解,这里就不再进一步说明了。 图7-2 用Expore过程进行正态性检验 top↑

计量经济学多元线性回归、多重共线性、异方差实验报告概要

计量经济学实验报告

多元线性回归、多重共线性、异方差实验报告 一、研究目的和要求: 随着经济的发展,人们生活水平的提高,旅游业已经成为中国社会新的经济增长点。旅游产业是一个关联性很强的综合产业,一次完整的旅游活动包括吃、住、行、游、购、娱六大要素,旅游产业的发展可以直接或者间接推动第三产业、第二产业和第一产业的发展。尤其是假日旅游,有力刺激了居民消费而拉动内需。2012年,我国全年国内旅游人数达到30.0亿人次,同比增长13.6%,国内旅游收入2.3万亿元,同比增长19.1%。旅游业的发展不仅对增加就业和扩大内需起到重要的推动作用,优化产业结构,而且可以增加国家外汇收入,促进国际收支平衡,加强国家、地区间的文化交流。为了研究影响旅游景区收入增长的主要原因,分析旅游收入增长规律,需要建立计量经济模型。 影响旅游业发展的因素很多,但据分析主要因素可能有国内和国际两个方面,因此在进行旅游景区收入分析模型设定时,引入城镇居民可支配收入和旅游外汇收入为解释变量。旅游业很大程度上受其产业本身的发展水平和从业人数影响,固定资产和从业人数体现了旅游产业发展规模的内在影响因素,因此引入旅游景区固定资产和旅游业从业人数作为解释变量。因此选取我国31个省市地区的旅游业相关数据进行定量分析我国旅游业发展的影响因素。 二、模型设定 根据以上的分析,建立以下模型 Y=β 0+β1X 1 +β2X 2 +β 3 X 3 +β 4 X 4 +Ut 参数说明: Y ——旅游景区营业收入/万元 X 1 ——旅游业从业人员/人 X 2 ——旅游景区固定资产/万元 X 3 ——旅游外汇收入/万美元 X 4 ——城镇居民可支配收入/元

计量经济学简单线性回归实验报告精编

实验报告 1. 实验目的随着中国经济的发展,居民的常住收入水平不断提高,粮食销售量也不断增长。研究粮食年销售量与人均收入之间的关系,对于探讨粮食年销售量的增长的规律性有重要的意义。 2. 模型设定 为了分析粮食年销售量与人均收入之间的关系,选择“粮食年销售量” 为被解释变量(用Y 表示),选择“人均收入”为解释变量(用X 表 示)。本次实验报告数据取自某市从1974 年到1987 年的数据(教材书上101页表3.11),数据如下图所示:

1粮食年销售量Y/万吨人均收入X/ rF1974[ 9& 45153.2 1975100.7190 pl1976102.8240.3 1977133. 95301.12 [61978140.13361 71979143.11420 8—1980146.15491.76「91981144.6501 101982148. 94529.2 1 11-1983158.55552. 72匸1984169. 68771.16 131985P 162.1481L8 14二1986170. 09988.43 1519871F& 691094.65为分析粮食年销售量与人均收入的关系,做下图所谓的散点图 从散点图可以看出粮食年销售量与人均收入大体呈现为线性关 系,可以建立如下简单现行回归模型: 3?估计参数

Y t = ■? 1 2 X t ——I t 假定所建模型及其中的随机扰动项叫满足各项古典假定,可以 用OLS法估计其参数。 通过利用EViews对以上数据作简单线性回归分析,得出回归结果如下表所示: Dependent Variable Y Method: Least Squares Date 10/15/11 Time 14 49 Sample- 1 14 Included observations: 14 Variable Coefficient Std Error t-Statistic Prob C99 61349 6 431242 15 489000 0000 X0.0814700.010738 7.5071190.0000 R-squared0 827493Mean dependent var142 7129 Adjusted R-squared0 813123S.D. dependent var26.09805 S E of regression11 28200Akaike info criterion7 915858 Sum squared resid1527 403Schwarz criterion7 907152 Log likelihood-52.71101F-statisti c5756437 Durbin-V/atson stat0 638969Prob(尸-statistic)0 000006 可用规范的形式将参数估计和检验的结果写为: A Y t =99.61349+0.08147 X t (6.431242)(0.10738) t= (15.48900) (7.587119) R2=0.827498 F=57.56437 n=14 4?模型检验 (1).经济意义检验 A A 所估计的参数1=99.61349, 1 2=0.08147,说明人均收入每增加 1元,平均说来可导致粮食年销售量提高0.08147元。这与经济学中

单因素方差分析与多重比较

单因素方差分析 单因素方差分析也称作一维方差分析。它检验由单一因素影响的一个(或几个相互独立的)因变量由因素各水平分组的均值之间的差异是否具有统计意义。还可以对该因素的若干水平分组中哪一组与其他各组均值间具有显著性差异进行分析,即进行均值的多重比较。One-Way ANOVA过程要求因变量属于正态分布总体。如果因变量的分布明显的是非正态,不能使用该过程,而应该使用非参数分析过程。如果几个因变量之间彼此不独立,应该用Repeated Measure过程。 [例子] 调查不同水稻品种百丛中稻纵卷叶螟幼虫的数量,数据如表5-1所示。 表5-1 不同水稻品种百丛中稻纵卷叶螟幼虫数 数据保存在“DATA5-1.SAV”文件中,变量格式如图5-1。 图5-1 分析水稻品种对稻纵卷叶螟幼虫抗虫性是否存在显著性差异。 1)准备分析数据

在数据编辑窗口中输入数据。建立因变量“幼虫”和因素水平变量“品种”,然后输入对应的数值,如图5-1所示。或者打开已存在的数据文件“DATA5-1.SAV”。 2)启动分析过程 点击主菜单“Analyze”项,在下拉菜单中点击“Compare Means”项,在右拉式菜单中点击 “0ne-Way ANOVA”项,系统 打开单因素方差分析设置窗口如图5-2。 图5-2 单因素方差分析窗口 3)设置分析变量 因变量:选择一个或多个因子变量进入“Dependent List”框中。本例选择“幼虫”。 因素变量:选择一个因素变量进入“Factor”框中。本例选择“品种”。 4)设置多项式比较 单击“Contrasts”按钮,将打开如图5-3所示的对话框。该对话框用于设置均值的多项式比较。

多元线性回归模型实验报告

多元线性回归模型实验报告 13级财务管理 101012013101 蔡珊珊 【摘要】首先做出多元回归模型,对于解释变量作出logx等变换,选择拟合程度最高的模型,然后判断出解释变量之间存在相关性,然后从检验多重线性性入手,由于解释变量之间有的存在严重的线性性,因此采用逐步回归法,将解释变量进行筛选,保留对模型解释能力较强的解释变量,进而得出一个初步的回归模型,最后对模型进行异方差和自相关检验。 【操作步骤】1.输入解释变量与被解释变量的数据 2.作出回归模型

R^2=0.966951 DW=0.626584 F-statictis=241.3763 ②我们令y1=log(consumption),x4=log(people),x5=log(price),x6=log(retained),x7= log(gdp), 作出回归模型

② 发现拟合程度很高,也通过了F检验与T检验。但是我们首先检查模型的共线性 发现x4与x6,x4与x7,x6与x7存在很强的共线性,对模型会造成严重影响。

目前暂用模型y1=10.55028-3.038439x4-0.236518x5+2.647396x6-0.557805x7,我们将陆续进行调整。 3.分别作出各解释变量与被解释变量之间的线性模型

①作出汽车消费量与汽车保有量之间的线性回归模型 R^2=0.956231 DW=0.147867 F-statistic=786.4967

因为prob小于α置信度,则可说明β1不明显为零。经济意义存在 Y1^=4.142917 + 0.761197x6 (8.283960) (28.04455)

matlab多元线性回归模型

云南大学数学与统计学实验教学中心 实验报告 一、实验目的 1.熟悉MATLAB的运行环境. 2.学会初步建立数学模型的方法 3.运用回归分析方法来解决问题 二、实验内容 实验一:某公司出口换回成本分析 对经营同一类产品出口业务的公司进行抽样调查,被调查的13家公司,其出口换汇成本与商品流转费用率资料如下表。试分析两个变量之间的关系,并估计某家公司商品流转费用率是6.5%的出口换汇成本. 实验二:某建筑材料公司的销售量因素分析 下表数据是某建筑材料公司去年20个地区的销售量(Y,千方),推销开支、实际帐目数、同类商品

竞争数和地区销售潜力分别是影响建筑材料销售量的因素。1)试建立回归模型,且分析哪些是主要的影响因素。2)建立最优回归模型。 提示:建立一个多元线性回归模型。

三、实验环境 Windows 操作系统; MATLAB 7.0. 四、实验过程 实验一:运用回归分析在MATLAB 里实现 输入:x=[4.20 5.30 7.10 3.70 6.20 3.50 4.80 5.50 4.10 5.00 4.00 3.40 6.90]'; X=[ones(13,1) x]; Y=[1.40 1.20 1.00 1.90 1.30 2.40 1.40 1.60 2.00 1.00 1.60 1.80 1.40]'; plot(x,Y,'*'); [b,bint,r,rint,stats]=regress(Y,X,0.05); 输出: b = 2.6597 -0.2288 bint = 1.8873 3.4322 -0.3820 -0.0757 stats = 0.4958 10.8168 0.0072 0.0903 即==1,0?6597.2?ββ,-0.2288,0?β的置信区间为[1.8873 3.4322],1,?β的置信区间为[-0.3820 -0.0757]; 2r =0.4958, F=10.8168, p=0.0072 因P<0.05, 可知回归模型 y=2.6597-0.2288x 成立. 1 1.5 2 2.5 散点图 估计某家公司商品流转费用率是6.5%的出口换汇成本。将x=6.5代入回归模型中,得到 >> x=6.5; >> y=2.6597-0.2288*x y = 1.1725

多元线性回归模型实验报告 计量经济学

实验报告 课程名称金融计量学 实验项目名称多元线性回归模型班级与班级代码 实验室名称(或课室) 专业 任课教师xxx 学号:xxx 姓名:xxx 实验日期:2012年5 月3日 广东商学院教务处制

姓名xxx 实验报告成绩 评语: 指导教师(签名) 年月日说明:指导教师评分后,实验报告交院(系)办公室保存

多元线性回归模型 一、实验目的 通过上机实验,使学生能够使用 Eviews 软件估计可化为线性回归模型的非线性模型,并对线性回归模型的参数线性约束条件进行检验。二、实验内容 (一)根据中国某年按行业分的全部制造业国有企业及规模以上制造业非国有企业的工业总产值Y,资产合计K及职工人数L进行回归分析。(二)掌握可化为线性多元非线性回归模型的估计和多元线性回归模型的线性约束条件的检验方法 (三)根据实验结果判断中国该年制造业总体的规模报酬状态如何?三、实验步骤 (一)收集数据 下表列示出来中国某年按行业分的全部制造业国有企业及规模以上制造业非国有企业的工业总产值Y,资产合计K及职工人数L。 序号工业总产值Y (亿元) 资产合计K (亿元) 职工人数L (万人)序号 工业总产 值Y(亿元) 资产合计K (亿元) 职工人数L (万人) 1 3722.7 3078.2 2 11 3 17 812.7 1118.81 43 2 1442.52 1684.4 3 67 18 1899.7 2052.16 61 3 1752.37 2742.77 8 4 19 3692.8 5 6113.11 240 4 1451.29 1973.82 27 20 4732.9 9228.2 5 222 5 5149.3 5917.01 327 21 2180.23 2866.65 80 6 2291.16 1758.7 7 120 22 2539.76 2545.63 96 7 1345.17 939.1 58 23 3046.95 4787.9 222 8 656.77 694.94 31 24 2192.63 3255.29 163 9 370.18 363.48 16 25 5364.83 8129.68 244 10 1590.36 2511.99 66 26 4834.68 5260.2 145 11 616.71 973.73 58 27 7549.58 7518.79 138 12 617.94 516.01 28 28 867.91 984.52 46 13 4429.19 3785.91 61 29 4611.39 18626.94 218 14 5749.02 8688.03 254 30 170.3 610.91 19 15 1781.37 2798.9 83 31 325.53 1523.19 45 16 1243.07 1808.44 33 表1

违背基本假设的问题:多重共线性异方差和自相关

第5章、违背基本假设的问题: 多重共线性、异方差和自相关 回顾并再次记住最小二乘法(LS)的三个基本假设: 1.y=Xβ+ε 2.Rank(X)=K 3.ε|X~N(0,σ2I) 1 / 51

§1、多重共线性(multicollinearity) 1、含义及后果 1)完全的多重共线性 如果存在完全的多重共线性(perfect multicollinearity),即在X中存在不完全为0的a i,使得 a1x1+…+a K x K=0 即X的列向量之间存在线性相关。因此,有Rank(X)

3 / 51

4 / 51 2)近似共线性 常见为近似共线性,即 a 1x 1+…+a K x K ≈0 则有|X’X|≈0,那么(X’X)-1对角线元素较大。由于 21|[,(')]b X N X X βσ- , 21|[,(')]k k kk b X N X X βσ- , 所以b k 的方差将较大。 例子:Longley 是著名例子。

5 / 51

6 / 51 2、检验方法 1)VIF 法(方差膨胀因子法,variance inflation factor ) 第j 个解释变量的VIF 定义为 2 1 VIF 1j j R = - 此处2j R 是第j 个解释变量对其他解释变量进行回归的确定系数。若2j R 接近于1,那么VIF 数值将较大,说明第j 个解释变量与其他解释变量之间存在线性关系。从而,可以用VIF 来度量多重共线性的严重程度。当 2j R 大于0.9,也就是VIF 大于10时,认为自变量之间存在比较严重的

一元线性回归分析实验报告

一元线性回归在公司加班制度中的应用 院(系): 专业班级: 学号姓名: 指导老师: 成绩: 完成时间:

一元线性回归在公司加班制度中的应用 一、实验目的 掌握一元线性回归分析的基本思想和操作,可以读懂分析结果,并写出回归方程,对回归方程进行方差分析、显著性检验等的各种统计检验 二、实验环境 SPSS21.0 windows10.0 三、实验题目 一家保险公司十分关心其总公司营业部加班的程度,决定认真调查一下现状。经10周时间,收集了每周加班数据和签发的新保单数目,x 为每周签发的新保单数目,y 为每周加班时间(小时),数据如表所示 y 3.5 1.0 4.0 2.0 1.0 3.0 4.5 1.5 3.0 5.0 2. x 与y 之间大致呈线性关系? 3. 用最小二乘法估计求出回归方程。 4. 求出回归标准误差σ∧ 。 5. 给出0 β∧与1 β∧ 的置信度95%的区间估计。 6. 计算x 与y 的决定系数。 7. 对回归方程作方差分析。 8. 作回归系数1 β∧ 的显著性检验。 9. 作回归系数的显著性检验。 10.对回归方程做残差图并作相应的分析。

11.该公司预测下一周签发新保单01000 x=张,需要的加班时间是多少? 12.给出0y的置信度为95%的精确预测区间。 13.给出 () E y的置信度为95%的区间估计。 四、实验过程及分析 1.画散点图 如图是以每周加班时间为纵坐标,每周签发的新保单为横坐标绘制的散点图,从图中可以看出,数据均匀分布在对角线的两侧,说明x和y之间线性关系良好。 2.最小二乘估计求回归方程

用SPSS 求得回归方程的系数01,ββ分别为0.118,0.004,故我们可以写出其回归方程如下: 0.1180.004y x =+ 3.求回归标准误差σ∧ 由方差分析表可以得到回归标准误差:SSE=1.843 故回归标准误差: 2= 2SSE n σ∧-,2σ∧=0.48。 4.给出回归系数的置信度为95%的置信区间估计。 由回归系数显著性检验表可以看出,当置信度为95%时:

多元线性回归模型实验报告

多元线性回归模型 一、实验目的 通过上机实验,使学生能够使用Eviews 软件估计可化为线性回归模型的非线性模型,并对线性回归模型的参数线性约束条件进行检验。二、实验内容 (一)根据中国某年按行业分的全部制造业国有企业及规模以上制造业非国有企业的工业总产值Y,资产合计K及职工人数L进行回归分析。(二)掌握可化为线性多元非线性回归模型的估计和多元线性回归模型的线性约束条件的检验方法 (三)根据实验结果判断中国该年制造业总体的规模报酬状态如何?三、实验步骤 (一)收集数据 下表列示出来中国某年按行业分的全部制造业国有企业及规模以上制造业非国有企业的工业总产值Y,资产合计K及职工人数L。 序号工业总产值Y (亿元) 资产合计K (亿元) 职工人数L (万人)序号 工业总产 值Y(亿元) 资产合计K (亿元) 职工人数L (万人) 1 3722.7 3078.2 2 11 3 17 812.7 1118.81 43 2 1442.52 1684.4 3 67 18 1899.7 2052.16 61 3 1752.37 2742.77 8 4 19 3692.8 5 6113.11 240 4 1451.29 1973.82 27 20 4732.9 9228.2 5 222 5 5149.3 5917.01 327 21 2180.23 2866.65 80 6 2291.16 1758.7 7 120 22 2539.76 2545.63 96 7 1345.17 939.1 58 23 3046.95 4787.9 222 8 656.77 694.94 31 24 2192.63 3255.29 163 9 370.18 363.48 16 25 5364.83 8129.68 244 10 1590.36 2511.99 66 26 4834.68 5260.2 145 11 616.71 973.73 58 27 7549.58 7518.79 138 12 617.94 516.01 28 28 867.91 984.52 46 13 4429.19 3785.91 61 29 4611.39 18626.94 218 14 5749.02 8688.03 254 30 170.3 610.91 19 15 1781.37 2798.9 83 31 325.53 1523.19 45 16 1243.07 1808.44 33 表1

第四章 多重共线性 答案(1)

第四章 多重共线性 一、判断题 1、多重共线性是一种随机误差现象。(F ) 2、多重共线性是总体的特征。(F ) 3、在存在不完全多重共线性的情况下,回归系数的标准差会趋于变小,相应的t 值会趋于变大。(F ) 4、尽管有不完全的多重共线性,OLS 估计量仍然是最优线性无偏估计量。(T ) 5、在高度多重共线的情形中,要评价一个或多个偏回归系数的个别显著性是不可能的。(T ) 6、变量的两两高度相关并不表示高度多重共线性。(F ) 7、如果分析的目的仅仅是预测,则多重共线性一定是无害的。(T ) 8、在多元回归中,根据通常的t 检验,每个参数都是统计上不显著的,你就不会得到一个高的2 R 值。(F ) 9、如果简单相关系数检测法证明多元回归模型的解释变量两两不相关,则可以判断解释变量间不存在多重共线性。( F ) 10、多重共线性问题的实质是样本问题,因此可以通过增加样本信息得到改善。(T ) 11、虽然多重共线性下,很难精确区分各个解释变量的单独影响,但可据此模型进行预测。(T ) 12、如果回归模型存在严重的多重共线性,可不加分析地去掉某个解释变量从而消除多重共线性。(F ) 13、多重共线性的存在会降低OLS 估计的方差。(F ) 14、随着多重共线性程度的增强,方差膨胀因子以及系数估计误差都在增大。(T ) 15、解释变量和随机误差项相关,是产生多重共线性的原因。(F ) 16、对于模型i ni n i 110i u X X Y ++++=βββ ,n 1i ,, =;如果132X X X -=,模型必然存在解释变量的多重共线性问题。(T ) 17、多重共线性问题是随机扰动项违背古典假定引起的。(F ) 18、存在多重共线性时,模型参数无法估计。(F ) 二、单项选择题 1、在线性回归模型中,若解释变量1X 和2X 的观测值成比例,既有12i i X kX =,其中k 为 非零常数,则表明模型中存在 ( B ) A 、异方差 B 、多重共线性 C 、序列相关 D 、随机解释变量 2、 在多元线性回归模型中,若某个解释变量对其余解释变量的可决系数接近1,则表明模型中存在 ( C ) A 、异方差性 B 、序列相关

计量经济学 简单线性回归 实验报告.doc

实验报告 1.实验目的 随着中国经济的发展,居民的常住收入水平不断提高,粮食销售量也不断增长。研究粮食年销售量与人均收入之间的关系,对于探讨粮食年销售量的增长的规律性有重要的意义。 2.模型设定 为了分析粮食年销售量与人均收入之间的关系,选择“粮食年销售量”为被解释变量(用Y表示),选择“人均收入”为解释变量(用X表示)。本次实验报告数据取自某市从1974年到1987年的数据(教材书上101页表3.11),数据如下图所示: 为分析粮食年销售量与人均收入的关系,做下图所谓的散点图:

粮食年销售量与人均收入的散点图 从散点图可以看出粮食年销售量与人均收入大体呈现为线性关系,可以建立如下简单现行回归模型: 3.估计参数 假定所建模型及其中的随机扰动项 i μ满足各项古典假定,可以 用OLS 法估计其参数。 通过利用EViews 对以上数据作简单线性回归分析,得出回归结果如下表所示: t t t X Y μββ++=21

可用规范的形式将参数估计和检验的结果写为: =t Y ^ 99.61349+0.08147 t X (6.431242)(0.10738) t= (15.48900) (7.587119) 2R =0.827498 F=57.56437 n=14 4.模型检验 (1).经济意义检验 所估计的参数1^β=99.61349,2^β=0.08147,说明人均收入每增加1元,平均说来可导致粮食年销售量提高0.08147元。这与经济学中边际消费倾向的意义相符。 (2).拟合优度和统计检验 拟合优度的度量:由回归结果表可以看出,本实验中可决系数为0.827498,说明所建模型整体上对样本数据拟合一般偏好。 对回归系数的t 检验:针对0H :1β=0 和0H :2β=0,由回归结果表 中还可以看出,估计的回归系数1^β的标准误差和t 值分别为:SE(1^β)=6.431242,t(1^β)=15.48900; 2^β的标准误差和 t 值分别为:SE(2^β)=0.10738,t(2^β)=7.587119.取a=0.05,查t 分布表自由度为 n-2=14-2=12的临界值025.0t (12)=2.179.因为t(1^β)=15.48900>025.0t (12)=2.179, 所以应拒绝0H :1β=0;因为t(2^ β)=7.587119>025.0t (12)=2.179. 所以应拒绝0H :2β=0。这表明,人均收入对粮食年销售量确有显著影 响。

多元线性回归实验报告

实验题目:多元线性回归、异方差、多重共线性 实验目的:掌握多元线性回归的最小二乘法,熟练运用Eviews软件的多元线性回归、异方差、多重共线性的操作,并能够对结果进行相应的分析。 实验内容:习题3.2,分析1994-2011年中国的出口货物总额(Y)、工业增加值(X2)、人民币汇率(X3),之间的相关性和差异性,并修正。 实验步骤: 1.建立出口货物总额计量经济模型: 错误!未找到引用源。(3.1) 1.1建立工作文件并录入数据,得到图1 图1 在“workfile"中按住”ctrl"键,点击“Y、X2、X3”,在双击菜单中点“open group”,出现数据 表。点”view/graph/line/ok”,形成线性图2。 图2 1.2对(3.1)采用OLS估计参数 在主界面命令框栏中输入ls y c x2 x3,然后回车,即可得到参数的估计结果,如图3所示。

图 3 根据图3中的数据,得到模型(3.1)的估计结果为 (8638.216)(0.012799)(9.776181) t=(-2.110573) (10.58454) (1.928512) 错误!未找到引用源。错误!未找到引用源。F=522.0976 从上回归结果可以看出,拟合优度很高,整体效果的F检验通过。但当错误!未找到引用源。=0.05时,错误!未找到引用源。=错误!未找到引用源。2.131.有重要变量X3的t检验不显著,可能存在严重的多重共线性。 2.多重共线性模型的识别 2.1计算解释变量x2、x3的简单相关系数矩阵。 点击Eviews主画面的顶部的Quick/Group Statistics/Correlatios弹出对话框在对话框中输入解释变量x2、x3,点击OK,即可得出相关系数矩阵(同图4)。 相关系数矩阵 图4 由图4相关系数矩阵可以看出,各解释变量相互之间的相关系数较高,证实解释变量之间存在多重共线性。 2.2多重共线性模型的修正

计量经济学 简单线性回归 实验报告

实验报告 1. 实验目的 随着中国经济的发展,居民的常住收入水平不断提高,粮食销售量也不断增长。研究粮食年销售量与人均收入之间的关系,对于探讨粮食年销售量的增长的规律性有重要的意义。 2. 模型设定 为了分析粮食年销售量与人均收入之间的关系,选择“粮食年销售量”为被解释变量(用Y表示),选择“人均收入”为解释变量(用X 表示)。本次实验报告数据取自某市从1974年到1987年的数据(教材书上101页表3.11),数据如下图所示: 为分析粮食年销售量与人均收入的关系,做下图所谓的散点图: 粮食年销售量与人均收入的散点图 从散点图可以看出粮食年销售量与人均收入大体呈现为线性关系,可以建立如下简单现行回归模型:

3.估计参数 假定所建模型及其中的随机扰动项满足各项古典假定,可以用OLS 法估计其参数。 通过利用EViews对以上数据作简单线性回归分析,得出回归结果如下表所示: 可用规范的形式将参数估计和检验的结果写为: 99.61349+0.08147 (6.431242)(0.10738) t= (15.48900) (7.587119) =0.827498 F=57.56437 n=14 4.模型检验 (1).经济意义检验 所估计的参数=99.61349,=0.08147,说明人均收入每增加1元,平均说来可导致粮食年销售量提高0.08147元。这与经济学中边际消费倾向的意义相符。 (2).拟合优度和统计检验 拟合优度的度量:由回归结果表可以看出,本实验中可决系数为0.827498,说明所建模型整体上对样本数据拟合一般偏好。 对回归系数的t检验:针对:=0 和:=0,由回归结果表中还可以看出,估计的回归系数的标准误差和t值分别为:SE()=6.431242,t()=15.48900;的标准误差和t值分别为:SE()=0.10738,t()=7.587119.取a=0.05,查t分布表自由度为n-2=14-2=12的临界值(12)=2.179.因为t()=15.48900>(12)=2.179, 所以应拒绝:=0;因为t()=7.587119>(12)=2.179.所以应拒绝:=0。

多元线性回归Wald检验

湖南商学院模拟实验报告

X2 X3 R-squared Mean depe ndent var Adjusted R-squared .dependent var Akaike info .of regressi on criterio n Sum squared resid Schwarz criterio n Hannan-Qu inn Log likelihood criter. F-statistic Durb in-Wats on stat Prob(F-statist ic) 3.利用命令计算随机干扰项的方差?2,并计算?的方差-协方差矩阵和相应的t统计量,并在5%的显着性水平下做参数的显着性检验; ⑴输入scalar deltahat2二eq01.@ssr/(22-4) 输入scalar deltahat=@sqrt(deltaha t2) 输入matrix var_cov_B=eq01.@coefcov or 在回归方程中点击viewCovarianee matrix (2)输入vector ttt=eq01.@tstats 4.对如下的假设做Wald检验: eq01viewcoefficient test waldc(2)=0,c(3)=0 Wald Test: Equatio n: EQ01 Test Probabili Statistic Value df ty F-stati stic (2, 18) Chi-squ 2

P值为0拒绝为假设,所以c(2)不等于0, c(3)也不等于0 实验结果与分析: 讨论与心得: 成绩评定评阅教师评阅时间

相关主题