
线性回归和方差分析
|
345
#> rstudent unadjusted p-value Bonferonni p
#> 28 4.46 7.76e-05 0.0031
outlierTest 识别出了模型大多数的离群观察值。在这个例子中,它识别了观察值 28 号,
并且确认它是一个离群值。
11.16.4 另请参阅
参见 11.4 节和 11.17 节。car 包不是 R 的标准发布版的一部分;有关如何安装,请参阅
3.10 节。
11.17 识别有影响的观察值
11.17.1 问题
需要识别对回归模型影响最大的观察值。这对于诊断数据中可能存在的问题很有用。
11.17.2 解决方案
influence.measures 函数报告了几个有用的统计量,用于识别有影响的观察值,并
用星号(*)标记显著的观察值。它的主要参数是回归得到的模型对象:
influence.measures(m)
11.17.3 讨论
这个方案的标题可能是“识别有
过度
影响的观察值”,但这可能是多余的。所有观察值都
会影响回归模型,哪怕只是一点点影响。当统计学家说观察值是有影响的(influential)
时,这意味着删除这个观察值将显著改变拟合的回归模型。我们需要识别这些观察结
果,因为它们可能是扭曲我们模型的离群值。我们应该自己调查这些值。
函数 influence.measures 报告了几个统计量:DFBETAS、DFFITS、协方差比、库克
(Cook)距离和帽子矩阵值。如果这些度量值中的任何一个表明一个观察值是有影响的,
那么该函数会在该观察值右侧用一个星号( ...