问答文章1 问答文章501 问答文章1001 问答文章1501 问答文章2001 问答文章2501 问答文章3001 问答文章3501 问答文章4001 问答文章4501 问答文章5001 问答文章5501 问答文章6001 问答文章6501 问答文章7001 问答文章7501 问答文章8001 问答文章8501 问答文章9001 问答文章9501

缺失值在回归前一般是要处理的,有多种处理方式.1均值替代;2多重补漏分析

发布网友 发布时间:2022-04-24 14:47

我来回答

1个回答

热心网友 时间:2023-10-17 03:41

(一)个案剔除法(Listwise Deletion)
最常见、最简单的处理缺失数据的方法是用个案剔除法(listwise
deletion),也是很多统计(如SPSS和SAS)默认的缺失值处理方法。在这种方法中如果任何一个变量含有缺失数据的话,就把相对应的个案从分析中剔除。如果缺失值所占比例比较小的话,这一方法十分有效。至于具体多大的缺失比例算是“小”比例,专家们意见也存在较大的差距。有学者认为应在5%以下,也有学者认为20%以下即可。然而,这种方法却有很大的局限性。它是以减少样本量来换取信息的完备,会造成资源的大量浪费,丢弃了大量隐藏在这些对象中的信息。在样本量较小的情况下,删除少量对象就足以严重影响到数据的客观性和结果的正确性。因此,当缺失数据所占比例较大,特别是当缺数据非随机分布时,这种方法可能导致数据发生偏离,从而得出错误的结论。
(二)均值替换法(Mean Imputation)
在变量十分重要而所缺失的数据量又较为庞大的时候,个案剔除法就遇到了困难,因为许多有用的数据也同时被剔除。围绕着这一问题,研究者尝试了各种各样的办法。其中的一个方法是均值替换法(mean
imputation)。我们将变量的属性分为数值型和非数值型来分别进行处理。如果缺失值是数值型的,就根据该变量在其他所有对象的取值的平均值来填充该缺失的变量值;如果缺失值是非数值型的,就根据统计学中的众数原理,用该变量在其他所有对象的取值次数最多的值来补齐该缺失的变量值。但这种方法会产生有偏估计,所以并不被推崇。均值替换法也是一种简便、快速的缺失数据处理方法。使用均值替换法插补缺失数据,对该变量的均值估计不会产生影响。但这种方法是建立在完全随机缺失(MCAR)的假设之上的,而且会造成变量的方差和标准差变小。
(三)热卡填充法(Hotdecking)
对于一个包含缺失值的变量,热卡填充法在数据库中找到一个与它最相似的对象,然后用这个相似对象的值来进行填充。不同的问题可能会选用不同的标准来对相似进行判定。最常见的是使用相关系数矩阵来确定哪个变量(如变量Y)与缺失值所在变量(如变量X)最相关。然后把所有个案按Y的取值大小进行排序。那么变量X的缺失值就可以用排在缺失值前的那个个案的数据来代替了。与均值替换法相比,利用热卡填充法插补数据后,其变量的标准差与插补前比较接近。但在回归方程中,使用热卡填充法容易使得回归方程的误差增大,参数估计变得不稳定,而且这种方法使用不便,比较耗时。
(四)回归替换法(Regression Imputation)
回归替换法首先需要选择若干个预测缺失值的自变量,然后建立回归方程估计缺失值,即用缺失数据的条件期望值对缺失值进行替换。与前述几种插补方法比较,该方法利用了数据库中尽量多的信息,而且一些统计(如Stata)也已经能够直接执行该功能。但该方法也有诸多弊端,第一,这虽然是一个无偏估计,但是却容易忽视随机误差,低估标准差和其他未知性质的测量值,而且这一问题会随着缺失信息的增多而变得更加严重。第二,研究者必须假设存在缺失值所在的变量与其他变量存在线性关系,很多时候这种关系是不存在的。
(五)多重替代法(Multiple Imputation)
多重估算是由Rubin等人于1987年建立起来的一种数据扩充和统计分析方法,作为简单估算的改进产物。首先,多重估算技术用一系列可能的值来替换每一个缺失值,以反映被替换的缺失数据的不确定性。然后,用标准的统计分析过程对多次替换后产生的若干个数据集进行分析。最后,把来自于各个数据集的统计结果进行综合,得到总体参数的估计值。由于多重估算技术并不是用单一的值来替换缺失值,而是试图产生缺失值的一个随机样本,这种方法反映出了由于数据缺失而导致的不确定性,能够产生更加有效的统计推断。结合这种方法,研究者可以比较容易地,在不舍弃任何数据的情况下对缺失数据的未知性质进行推断。NORM统计可以较为简便地操作该方法
声明声明:本网页内容为用户发布,旨在传播知识,不代表本网认同其观点,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。E-MAIL:11247931@qq.com
为什么来大姨妈胸会胀 少儿学什么舞蹈 青年学什么舞蹈好 成年人学什么舞蹈 福州企业最低工资标准 2013年厦门的底薪是多少 生产要素的需求有哪些性质 生产要素的需求有何特点? 什么是生产要素需求 微观经济学要素需求什么是条件要素需求?它和要素需求有什么不同?_百度... 如何处理数据中的缺失值 自己清洗羽绒服最佳方法是什么? 豆芽可以做什么菜》 豆芽炒土鸡蛋的做法,豆芽炒土鸡蛋怎么做好吃 粉丝豆芽炒鸡蛋的做法,粉丝豆芽炒鸡蛋怎么做 豆芽粉丝炒鸡蛋的做法,豆芽粉丝炒鸡蛋怎么做 炒鸡蛋的做法,豆芽粉丝炒鸡蛋怎么做好吃 粉条的12种新吃法是什么? 粉丝炒鸡蛋的做法,豆芽粉丝炒鸡蛋怎么做好 粉条豆芽炒鸡蛋的做法 《合衬[娱乐圈]》txt下载在线阅读全文,求百度网盘云资源 《热恋我》txt下载在线阅读全文,求百度网盘云资源 《第八封情书》txt下载在线阅读全文,求百度网盘云资源 合衬[娱乐圈]_by余北欢_txt全文免费阅读 热恋我_by余北欢_txt全文免费阅读 第八封情书_by余北欢_txt全文阅读,百度网盘免费下载 热恋我_by余北欢_txt全文阅读,百度网盘免费下载 《合衬》txt下载在线阅读全文,求百度网盘云资源 合衬[娱乐圈]_by余北欢_txt全文阅读,百度网盘免费下载 感觉17岁头皮屑特别多,基本上怎么洗都没用了。男生应该很正常。头皮屑多很正常? 统计数据缺失值产生的主要原因及解决方法研究 数据有缺失值,SPSS做回归的时候 这些缺失值会自动加进去吗 n不等的配对t检验,比例大概2:1,怎么用spss做?缺失的数据怎么处理呢?救急啊!! 如何用sas程序进行数据缺失值的填补imputation 数据缺失每年的1月份,用Eviews进行分析,怎么做? 如果我给别人ps一些图,收费。有些素材来自网络,但是别人不把我ps的图拿做商用,这样违法了么 我是不是侵犯别人肖像权了,我帮别人ps过一张照片,后来我把这照片传到网上宣传商品,如果对方起诉我赔 photoshop帮别人修图片的价格 什么软件可以帮别人做Ps 我想用ps帮别人处理图片,但是没人找我呀,需要的话,可以找我 怎么在土司网帮别人ps照片 我会PS能不能在网上给别人处理相片挣钱啊? 有专门帮人PS照片出钱的网站吗 求帮别人Ps图的PHOTOSHOP群 有没有人不要钱帮忙ps图片的 海底捞市值56天暴跌2000个亿,造成这一因素的主要原因是什么? 仅仅56天,海底捞市值暴跌超2000亿!大家为什么不喜欢去海底捞了? 56天暴跌2000亿,海底捞究竟经历了什么? 56天暴跌2000亿的海底捞,到底发生了什么造成如此境遇? 海底捞市值56天跌2000亿!新加坡首富身价大缩水!海底捞怎么了?