检测和过滤异常值

from pandas import Series
import pandas as pd
import numpy as np
#np.random.seed(12345)
data=pd.DataFrame(np.random.randn(1000,4))
#print(data.describe())
print(data[(np.abs(data)>3).any(1)])#超过3或者-3的行
#print(data[(data.abs()>3).any(1)])#超过3或者-3的行
data[np.abs(data)>3]=np.sign(data)*3#np.sign返回一个由1和-1组成的数组,表示原始值的符号
print(data.describe())
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值