SPSS异常值剔除

SPSS异常值剔除

ID:77922646

大小:128.63 KB

页数:5页

时间:2022-01-29

SPSS异常值剔除_第1页
SPSS异常值剔除_第2页
SPSS异常值剔除_第3页
SPSS异常值剔除_第4页
SPSS异常值剔除_第5页
资源描述:

《SPSS异常值剔除》由会员上传分享,免费在线阅读,更多相关内容在行业资料-天天文库

1、离群值(箱图/探索).值与框的上下边界的距离在倍框的长度到3倍框的长度之间的个案。框的长度是内距。极端值(箱图).值距离框的上下边界超过3倍框的长度的个案。在回归模型诊断里面,一般称预测值与实际值的偏差为"残差",残差有几种表示方法:标准化残差,学生化残差等等,按照需要取一种残差,再按照某种标准取一个阀值来限定异常点,只要那个点的残差大于阀值,就可以认为它是异常点。data下拉菜单里有definevariableproperties,把变量选到右边的框里,点continue,在新窗口中有变量在样本中的所有取值,要定义某

2、个值是异常值,就把相应的missing框勾上就ok啦~~~然后再处理数据时这些值就已经被剔除,不参与分析了一、采用数据探索过程探测异常值SPS磔单实现程序为:主菜单-->“Analyze"-->"DescriptiveStatistics"-->"Explore"选项-->“Statistics”按钮-->选中"Outliers”复选框。输出结果中将列出5个最大值和5个最小值作为异常的嫌疑值。一般数组应遵循正态分布,但一列数组中有可能会出现异常值,从而影响数据的方差和统计结果,因此挡在SPSM输入数据后,首先要检查数据

3、中是否存在异常值。方法如下:1.选择想要观察的数据,此处我们选择normal列中的数据进行查看2.进入菜单栏中“分析”一“描述统计”一“探索”3.将“normal”数组放入因变量列表中4.点击“探索”窗口中的“统计量”,点掉“描述性”,选择“界外值”和“百分位数”,选择“直方图”5.点击“探索”窗口中“绘制”,去掉“茎叶图”海索;图描述性。:茎叶图⑤)iiiiHfeiiiflmHIiiwilliM-iil箱图到接四子水平分组正)◎不分姐◎无...带检骗的正态的-伸展与能别Levon。检骗@无©系估计呻◎已转换工帚•自然

4、对敬一◎相退也)[维蝮][取瑞]需助)6.选择结束后点击“探索”窗口“确定”查看结果:(1)百分位数图:百分位数百分位数5102550759095加权平均(定义1)normalTukey的枢纽normal(2)以50%左右两个百分位数(即四分位数25和75下方的加权平均值)的加权平均值计算最高和最低临界值,使用计算公式如下:Upper=Q3+(Q3-Q1))Lower=Q1-(Q3-Q1))此处Q3=,Q1=计算后,Upper=,Lower=(3)查看“极值”表格:极值案例号值normal最高1202223244465

5、47最低181278375457554a.上限值表中仅显示一部分具有值的案例b.下限值表中仅显示一部分具有值的案例如果有最高值查过Upper,或最低值小于Lower值,则被视为Outliers,即异常值。由图中看,此列数组并无异常值二、采用箱线图(boxplot)探测异常值箱线图比较直观、形象,易于理解,因此它在统计分析中占有非常重要的地位。1.利用上述的数据探测过程,在“Explore”对话框中单击“Plots",出现如图2所示的对话框,通过"Boxplots”方框可以确定箱线图的生成方式。"Factorlevels

6、together”复选框表示将要为每个因变量创建一个箱线图,“Dependenttogether”复选框表示将为每个分组变量水平创建箱线图,“None”复选框表示不创建箱线图。2.直接利用SPS汕的画图功能实现箱线图,SPSS合出了两种箱线图,一种是基本箱线图,另一种是交互式箱线图。基本箱线图的SPS磔单实现为:点击主菜单中的“Graphs”选项,在弹出的一级菜单中选择“Boxplot……”选项。交互式箱形图的SPSS菜单实现为:点击主菜单中的"Graphs”选项,在弹出的一级菜单中点击“Interactive”选项,

7、在弹出的二级菜单中选择“Boxplot……”选项。下面仍以A公司雇员分工种的开始工资为例构造基本箱线图(如图3)。箱线图中的表示可疑的异常值,此处异常值的确定采用的是“五数概括法”,即:变量值超过第75百分位点和25百分位点上变量值之差的倍(箱体上方)或变量值小于第75百分位点和25百分位点上变量值之差的倍(箱体下方)的点对应的值。三、SPSS14后的新功能Data-->Validation:如何设置。。。四、Z分标准化法(38法):±38以外的数据为高度异常值,应予剔除。在异常数据的删除方法中,最常用的就是拉依达准则

8、法,即我们所熟知的38法,也就是把一组观测数据中与平均值的偏差超过两倍标准差范围的数据剔除。spss中的步骤如下:——、analyze>>descriptivestatistics>>descriptives>>选择变量(歹U)至U右边的框里>>点选savestandardizedvaluesasvariables>>选择ok二、

当前文档最多预览五页,下载文档查看全文

此文档下载收益归作者所有

当前文档最多预览五页,下载文档查看全文
温馨提示:
1. 部分包含数学公式或PPT动画的文件,查看预览时可能会显示错乱或异常,文件下载后无此问题,请放心下载。
2. 本文档由用户上传,版权归属用户,天天文库负责整理代发布。如果您对本文档版权有争议请及时联系客服。
3. 下载前请仔细阅读文档内容,确认文档内容符合您的需求后进行下载,若出现内容与标题不符可向本站投诉处理。
4. 下载文档时可能由于网络波动等原因无法下载或下载错误,付费完成后未能成功下载的用户请联系客服处理。