请选择 进入手机版 | 继续访问电脑版
楼主: 有福有德
8482 8

[学习资料] 异常值侦查 [推广有奖]

教师

院士

6%

还不是VIP/贵宾

-

威望
4
论坛币
56500 个
通用积分
8.4735
学术水平
344 点
热心指数
203 点
信用等级
274 点
经验
37400 点
帖子
1138
精华
10
在线时间
945 小时
注册时间
2010-10-14
最后登录
2024-3-21

有福有德 在职认证  发表于 2012-10-16 10:28:44 |显示全部楼层 |坛友微信交流群

+2 论坛币
k人 参与回答

经管之家送您一份

应届毕业生专属福利!

求职就业群
赵安豆老师微信:zhaoandou666

经管之家联合CDA

送您一个全额奖学金名额~ !

感谢您参与论坛问题回答

经管之家送您两个论坛币!

+2 论坛币
Spss中异常值检查方法:
检查异常值方法1:
       最常用的方法就是对变量进行排序,这也是最简单的方法。排序后对照最大值和最小值、全距等统计量可以看出数据的离群状况。

检查异常值方法2:
       散点图的优势就在于直观的呈现两两变量间的关系,尤其在两变量间的线性关联比较强的时候,如果有离群值,图形侦察的结果会很明显,不过(也包括矩阵散点等图形)其局限在于,其本质还是变量间的两两间的关系,更多的多维信息的提供还是需要经验去判断。

检查异常值方法3:
       箱体图为我们提供了数据百分位数的概念,例如四分位数(25%和75%)是将该变量分成约4个部分,分别提供了数据不同分位点附件的离散性,而且同时提供描述数据集中性的中位数,这样在中间50%的数据上提供的信息将是异常丰富的。

检查异常值方法4:
       在主要统计建模过程中大多会提供异常值或极端值的诊断,例如距离的测算:cook距离、杠杆值等;影响统计量:DfBeta、协方差比率等。它们均有相应的经验上的判断标准,如果有些指标没有相应的判断异常值的标准,则可以通过排序的方式,找到其相对大小。

检查异常值方法5:
       标识异常个案,这里提供的是统计建模的方式侦查异常个案(注意它的结果有可能和我们其他方式侦查的结果有出处),这种方法主要通过两步聚类的思想,找到不同个案间的相似性,通过对所在类别的评价计算出异常索引,然后找到对应的ID号,则该个案可能为异常值,至于对这些异常个案怎么处理,分析人员作出何种决定,这个最好结合专业背景综合判断后续的处理方法。

检查异常值方法6:
       如果涉及的是时序数据,控制图是不错的选择,在控制规则里提供了异常丰富的侦查异常个案的选项。
当然其他过程里也有一些细节的处理,例如,排列图、误差条形图、可视离散化、缺失值诊断、数据验证过程等。



二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

关键词:异常值 统计建模 SPSS 处理方法 beta 散点图 最大值 统计 信息

已有 1 人评分经验 学术水平 热心指数 信用等级 收起 理由
guo.bailing + 80 + 1 + 1 + 1 很好的总结

总评分: 经验 + 80  学术水平 + 1  热心指数 + 1  信用等级 + 1   查看全部评分

所有模型都是错的
ourfather 发表于 2012-10-16 11:35:32 |显示全部楼层 |坛友微信交流群
在数据统计分析师认证培训课程中,这几种具体的检查方法都会通过SPSS软件实际操作演示,同时在一些细微的处理上更加生动。

使用道具

Danielxie 发表于 2013-1-9 16:42:27 |显示全部楼层 |坛友微信交流群
谢谢分享!

使用道具

使用道具

zxmnz 发表于 2013-5-15 09:48:23 |显示全部楼层 |坛友微信交流群
学习啦,感谢

使用道具

KAKA_123 发表于 2014-3-30 02:19:33 |显示全部楼层 |坛友微信交流群
这么好的帖子为啥没人顶??顶起!

使用道具

liaodandan 发表于 2014-10-12 17:13:12 |显示全部楼层 |坛友微信交流群
学习了!!

使用道具

ureniy 发表于 2014-12-28 21:50:58 |显示全部楼层 |坛友微信交流群
下礼拜试试

使用道具

xmlb 发表于 2015-7-30 21:29:24 |显示全部楼层 |坛友微信交流群
学习啦,顶起

使用道具

您需要登录后才可以回帖 登录 | 我要注册

本版微信群
加好友,备注cda
拉您进交流群

京ICP备16021002-2号 京B2-20170662号 京公网安备 11010802022788号 论坛法律顾问:王进律师 知识产权保护声明   免责及隐私声明

GMT+8, 2024-3-29 15:28