多重共线性产生原因及处理办法+R语言+糖尿病数据案例分析+逐步回归法

本文探讨了多重共线性在时间序列和横截面数据中的产生,及其对回归参数估计的影响。介绍了多种判断共线性的方法,如方差膨胀因子和特征根判定法,并提出了消除共线性的策略,包括剔除不重要变量和使用岭回归等。以糖尿病数据为例,通过逐步回归法减少变量,降低了方差膨胀因子,提高了模型稳定性。
摘要由CSDN通过智能技术生成

1、多重共线性

多重共线性一般是在(1)时间序列数据和(2)横截面数据中会发生。

产生的影响

(1)OLS得到的回归参数估计值很不稳定
(2)回归系数的方差随共线性强度增加而增长
(3)系数的正负号得不到合理的解释

多重共线性的判定方法

1、方差膨胀因子vif
2、特征根判定法

3、直观判定法:更加直观
1.当增加或剔除一个自变量,或者改变一个观测值时,回归系数的估计值发生较大变化。
2.从定性分析认为,一些重要的自变量在回归方程中没有通过显著性检验。
3.有些自变量的回归系数所带正负号与定性分析结果违背。
4.自变量的相关矩阵中,自变量间的相关系数较大。
5.一些重要的自变量的回归系数的标准误差较大。

消除多重共线性

1、剔除一些不重要的解释变量
2、增大样本容量
3、回归系数的有偏估计
统计学家还致力于改进古典的最小二乘法,提出以采用有偏估计为代价来提高估计量稳定性的方法,如:
逐步回归
岭回归法
主成分回归法
偏最小二乘法
lasso回归
适应性lasso回归

2、糖尿病数据+逐步回归法

先看一下数据:

评论 11
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值