录入的时候可以直接省略不录入
分析的时候也一般剔除这样的样本。但也有替换的方法,一般有:
均值替换法(mean
imputation),即用其他个案中该变量观测值的平均数对缺失的数据进行替换,但这种方法会产生有偏估计,所以并不被推崇。
个别替换法(single
imputation)通常也被叫做回归替换法(regression
imputation),在该个案的其他变量值都是通过回归估计得到的情况下,这种
方法用缺失数据的条件期望值对它进行替换。这虽然是一个无偏估计,但是却倾向于低估标准差和其他未知性质的测量值,而且这一问题会随着缺失信息的增多而变得更加严重。
多重替代法(multiple
imputation)(rubin,
1977)
。
它从相似情况中或根据后来在可观测的数据上得到的缺省数据的分布情况给每个缺省数据赋予一个模拟值。结合这种方法,研究者可以比较容易地,在不舍弃任何数据的情况下对缺失数据的未知性质进行推断(little
and
rubin,1987;
ubin,1987,
1996)。