多重共线性产生原因及处理办法+R语言+糖尿病数据案例分析+逐步回归法

其他 2020-08-04 10:14:04 阅读次数: 0

1、多重共线性

多重共线性一般是在（1）时间序列数据和（2）横截面数据中会发生。

产生的影响

（1）OLS得到的回归参数估计值很不稳定
（2）回归系数的方差随共线性强度增加而增长
（3）系数的正负号得不到合理的解释

多重共线性的判定方法

1、方差膨胀因子vif
2、特征根判定法

3、直观判定法：更加直观
1.当增加或剔除一个自变量,或者改变一个观测值时,回归系数的估计值发生较大变化。
2.从定性分析认为,一些重要的自变量在回归方程中没有通过显著性检验。
3.有些自变量的回归系数所带正负号与定性分析结果违背。
4.自变量的相关矩阵中,自变量间的相关系数较大。
5.一些重要的自变量的回归系数的标准误差较大。

消除多重共线性

1、剔除一些不重要的解释变量
2、增大样本容量
3、回归系数的有偏估计
统计学家还致力于改进古典的最小二乘法,提出以采用有偏估计为代价来提高估计量稳定性的方法,如：
逐步回归
岭回归法
主成分回归法
偏最小二乘法
lasso回归
适应性lasso回归

2、糖尿病数据+逐步回归法

先看一下数据：
在这里插入图片描述
原模型的方差膨胀因子：几乎都非常大

这是逐步回归法的：

去除了大部分变量，保留了部分变量，方差膨胀因子相对小很多。
这是逐步回归法的残差与y的散点图：

以及模型：

大部分自变量通过了检验。
代码：
数据需要可以评论~

library("lars")
library("car")
#file.choose()
da<-read.csv("F:\\learning_kecheng\\huigui\\67章—多重共线性和lasso\\diabetes.csv")[,11:75]
head(da)

lm1<-lm(y~.,data = da)
lm_step = step(lm1,trace = F)
vif(lm1)
vif = vif(lm_step)
sort(vif(lm1),de=T)[1:5]
sort(vif)
summary(lm_step)

xx = cor(da[,-1])
kappa(xx,exact = TRUE)
kappa(da[,-1],exact = TRUE)

shapiro.test(lm_step$res)
Anova(lm_step,type="III")	
plot(da$y,lm_step$res)
abline(h=0,lty=2)

猜你喜欢

转载自blog.csdn.net/qq_42871249/article/details/104656084

多重共线性产生原因及处理办法+R语言+糖尿病数据案例分析+逐步回归法

回归模型中多重共线性问题——逐步回归法、方差膨胀因子（VIF）、因子分析【含代码与解释】

回归分析中的多重共线性问题

回归分析----多重共线性【基础】

多重共线性的诊断（R语言）

多重共线性诊断与R语言实践

多重共线性的处理方法

数据分析——多重共线性检验

回归模型中的多重共线性 + 危害 + 原因 + 判断标准 + 解决办法，回归系数

04 聊聊线性回归多重共线性

逻辑回归-建模后-多重共线性

多重共线性——岭回归定义+岭迹分析+岭参数选择

R语言之多重共线性的判别以及解决方法

多重共线性全流程分析

正则化线性模型+岭回归+lasso回归+弹性网络+糖尿病数据案例分析

Python 多重共线性检验

【机器学习笔记】：大话线性回归（三）多重共线性和强影响点分析

回归分析的几个问题：异方差性、自相关性、多重共线性

机器学习线性回归：谈谈多重共线性问题及相关算法

逻辑回归中解决多重共线性问题

Python统计学13——回归的多重共线性、异方差、自相关的检验

[DataAnalysis]多元线性回归深入浅出-案例+模型假设+参数估计方法+模型评判方法+变量选择+多重共线性问题

多重共线性的解决方法

多重共线性+变量选择（钟老师）

【Python计量】多重共线性的检验和解决

多重共线性问题如何解决？

逐步回归（R语言）

多重共线性的处理（一般现象，回归中，自变量系数从正变成负，不符合理论）

逐步回归分析 R语言逐步回归分析

线性回归-糖尿病预测

今日推荐

Linus “吃狗粮”最积极！

开源日报 | Winamp播放器即将开源；生成式AI之战升级第二轮；Linus“吃狗粮”最积极；AI进入泡沫前期；吴泳铭为阿里云带来了什么？

NetBSD 禁止提交由 AI 生成的代码

Apache Doris 2.0.10 版本正式发布！

开源日报 | 大模型开战；大模型独角兽被曝卖身；周鸿祎建议谷歌开源所有产品；最大开源AI社区提供1000万美元共享GPU

开源日报 | Chrome内置Gemini的意义不在于Gemini；中国AI追随之路的五大误区；ECharts创始人“下海”养鱼；谷歌I/O开发者大会什么都有，只是没有惊喜

微软回应中国区AI团队“打包赴美”传闻

周排行

SVN服务端安装在阿里云

实战 | 相机标定

webpack核心概念

note20——》只要肯低头吃苦，人生就会有救

PAT甲级 1062 Talent and Virtue （25 分）排序

NG Toolset开发笔记--5GNR Resource Grid（26）

如何对待上司

oracle命令

第9章 STL迭代器

logstash使用es映射模板

每日归档

更多

2024-05-20(36)

2024-05-19(0)

2024-05-18(4)

2024-05-17(34)

2024-05-16(6)

2024-05-15(24)

2024-05-14(0)

2024-05-13(18)

2024-05-12(0)

2024-05-11(38)