楼主: 我是小趴菜
876 0

[数据挖掘工具] 异常值、缺失值处理的常见思路? [推广有奖]

  • 0关注
  • 4粉丝

教授

35%

还不是VIP/贵宾

-

威望
0
论坛币
29650 个
通用积分
380.5350
学术水平
1 点
热心指数
1 点
信用等级
0 点
经验
7150 点
帖子
670
精华
0
在线时间
37 小时
注册时间
2022-8-30
最后登录
2023-4-4

楼主
我是小趴菜 发表于 2022-10-12 14:14:32 |AI写论文

+2 论坛币
k人 参与回答

经管之家送您一份

应届毕业生专属福利!

求职就业群
赵安豆老师微信:zhaoandou666

经管之家联合CDA

送您一个全额奖学金名额~ !

感谢您参与论坛问题回答

经管之家送您两个论坛币!

+2 论坛币

问题描述:

当我们在处理数据的时候,特别是某个字段的连续变量,如果存在异常值,例如极大值或极小值,会对模型产生较大影响,一般有哪些处理思路呢?又如何处理缺失值?



解决思路:

  • 对于异常值,可以直接剔除,也可以用平均值填补,极大值、极小值可以采用盖帽法(99%分位点、1%分位点)填充;spss中常用箱线图来观察,划出离群点并进行异常值处理
  • 对于缺失值,可以用平均值、众数进行填补,填补依据要结合业务理解,不同的缺失值比例,有不同的缺失值处理思路:

二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

关键词:缺失值处理 异常值 缺失值 处理缺失值 SPSS

您需要登录后才可以回帖 登录 | 我要注册

本版微信群
加好友,备注cda
拉您进交流群
GMT+8, 2026-1-11 15:58