异常值的检测

异常值的检测

z-分数

利用平均数和标准差,我们可以确定任何观察值的相对位置。假设我们有一个n个观测值x1,x2,…xn的样本,并且假设样本平均数和样本标准差已经被计算出来。与任何一个数值有关的另一个数值称为z-分数:
用样本中的数值减去样本总的平均值,然后除以样本标准差。
一个变量的数值转换成z-分数的过程常常被称为z变换。

经验法则

经验法则以正态分布为依据,用来确定与平均数的距离在某个特定个数的标准差之内的数据值所占的比例。

总结

有时数据集中会包含一个或多个数值异常大或异常小的观测值,这样的极端值称为异常值。有经验的统计人员会采取一定的步骤来识别异常值,并对它们仔细鉴别。
z-分数可以用来确认异常值。经验法则告诉我们,对于具有钟形分布的数据,几乎所有的数据值与平均数的距离都在3个标准差之内。因此,在利用z-分数来检测异常值时,我们建议把z-分数小于-3或大于+3的任何数值都视为异常值。
另一种确定异常值的方法是利用箱线图中的四分位法,其中定义下限为第一四分位数减去1.5倍的四分位数间距,上限为第三分位数加上1.5倍的四分位数间距。如果一个观测值的数值小于下限或大于上限,则被归类为异常值。

  • 0
    点赞
  • 4
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值