2023-10-10 19:43来源:m.sf1369.com作者:宇宇
一、造成多重共线性的原因
多重共线性问题就是说一个解释变量的变化引起另一个解释变量地变化。如果各个自变量x之间有很强的线性关系,就无法固定其他变量了,就找不到x和y之间真实的关系了。通俗地讲共线性是指,自变量X(解释变量)影响因变量Y(被解释变量)的时候,多个X之间本身就存在很强的相关关系,即X之间有着比较强的替代性,因而导致共线性问题。
二、多重共线性的检验
回归分析时,直接查看VIF值,如果全部小于10(严格是5),则说明模型没有多重共线性问题,模型构建良好;反之若VIF大于10说明模型构建较差。也可以直接做相关分析,如果某两个自变量X(解释变量)的相关系数值大于0.7,也有可能出现很强的共线性问题。
三、解决方法
共线性问题共有以下五种解决办法:1. 手动移除出共线性的自变量先做下相关分析,如果发现某两个自变量X(解释变量)的相关系数值大于0.7,则移除掉一个自变量(解释变量),然后再做回归分析。但此种办法有一个小问题,即有的时候根本就不希望把某个自变量从模型中剔除,如果有此类情况,可考虑使用逐步回归让软件自动剔除,同时更优的办法可能是使用岭回归进行分析。
2. 逐步回归法让软件自动进行自变量的选择剔除,逐步回归会将共线性的自变量自动剔除出去。此种解决办法有个问题是,可能算法会剔除掉本不想剔除的自变量,如果有此类情况产生,此时最好是使用岭回归进行分析。
3. 增加样本容量增加样本容量是解释共线性问题的一种办法,但在实际操作中可能并不太适合,原因是样本量的收集需要成本时间等。
4. 岭回归上述第1和第2种解决办法在实际研究中使用较多,但问题在于,如果实际研究中并不想剔除掉某些自变量,某些自变量很重要,不能剔除。此时可能只有岭回归最为适合了。岭回归是当前解决共线性问题最有效的解释办法,但是岭回归的分析相对较为复杂,后面会提供具体例子,当然也可以参考SPSSAU官网岭回归说明。
5. 利用因子分析合并变量共线性问题的解释办法是,理论上可以考虑使用因子分析(或者主成分分析),利用数学变换,将数据降维提取成几个成分,即把信息进行浓缩,最后以浓缩后的信息作为自变量(解释变量)进入 模型进行分析。此种解释办法在理论上可行,而且有效。但实际研究中会出现一个问题,即本身研究的X1,X2,X3等,进行了因子分析(或主成分)后,变成成分1,成分2类似这样的了,意义完全与实际研究情况不符合,这导致整个研究的思路也会变换,因而此种办法适用于探索性研究时使用,而不适合实际验证性研究。
四、处理原则
1.多重共线性是普遍存在的,轻微的多重共线性问题可不采取措施。
2.严重的多重共线性问题,一般可根据经验或通过分析回归结果发现。如影响系数符号,重要的解释变量t值很低。要根据不同情况采取必要措施。
3.如果模型仅用于预测,则只要拟合程度好,可不处理多重共线性问题,存在多重共线性的模型用于预测时,往往不影响预测结果。
上述说明中,最终岭回归是处理共线性问题最优的解释办法。下面以一个案例来讲述岭回归的具体分析处理,岭回归通过引入k个单位阵,使得回归系数可估计;单位阵引入会导致信息丢失,但同时可换来回归模型的合理估计。
五、SPSSAU中的应用
在SPSSAU(网页版SPSS)上,用户可以根据以上解决方法完成分析,并且系统会针对用户数据智能化分析,给出分析建议及规范化分析结果。
调出excel选项,点击加载项。在可用加载宏中,勾选分析工具库,点击确定。详细步骤:
工具/原料:
品闷孙牌型号:联滚乎想GeekPro2020
系统版本:Win10家庭版
软件版本:Microsoft Excel 2019
1、打开excel表格,点击文件。
2、点击选项。
3、调出excel选项,点击加载项。
4、选择分析工具库,点击转到。
5、在可用加载宏中,勾选分析工具库,点击确定。
6、点击数据分析。
7、在分析工具中,选择回归。
8、选择X,Y值输入区域,点击确定。
9、生成线蚂备链性回归分析表格。
1、单击开始---->所有程序---->Microsoft Office,选择Microsoft Excel 2010选项。
2、新建的Excel数据表格中,创建两行数据,用以分析。
3、岁梁段选中所有数据,渣激单击数据菜单项中的,数据分析选项。
4、乎誉默认情况下,Excel表格没有数据分析选项,此时需要添加它。单击文件菜单中的选项。
5、Excel选项中,选择加载项选项。
6、加载项中,选择分析工具库选项,单击确定。
1、首先要准备好两组数据做为x和y,这组数据在可以简单感觉一下是否具有线性关系。将准备好的数据放入excel表格里面
2、EXCEL需要我们自己启用数氏液据分析,点击文睁核芦件,选择选项,点击左侧的加载项,加载分析工具
3、加载工具完成以后,点击数据中的“工具分析”,选择“回归”,点击确定
4、点击Y值输入区域后面的单元格选择工具,选择Y值单元格,比如小编这里的A2:A20,X值同理操作,这里选择B2:B20,勾选下方的线性拟合图,我们可以看一下拟合的效果
5、excel会在新的工作表里面输出回归分析的相关结果,比如相关系数R^2,标准误差,悉带在X-variable和Intercept两项的值可以写出一元回归方程
excel中点 工具 ,里面的加载宏,勾上分析工具库,加载好后,工具里面会有一个数据分析
找到分析工具库,做回归分析,咐亮在x值的选择上,选取多区域的就是多元回归了,这个是线性的回归,其他的话,借助别的工祥数具可能更好谨简首