数据挖掘之心电图心跳信号分类之数据探索性分析

对特征

判断数据缺失和异常

x_train.isnull().sum()
x_test.isnull().sum()

偏度与峰度

sns.distplot(x_train['label']);
print("Skewness: %f" % Train_data['label'].skew())
print("Kurtosis: %f" % Train_data['label'].kurt())
sns.distplot(x_train.kurt(),color='orange',axlabel ='Kurtness')

对标签

了解预测值的分布

x_train['label']
x_train['label'].value_counts()
import scipy.stats as st
y = x_train['label']
plt.figure(1); plt.title('Default')
sns.distplot(y, rug=True, bins=20)
plt.figure(2); plt.title('Normal')
sns.distplot(y, kde=False, fit=st.norm)
plt.figure(3); plt.title('Log Normal')
sns.distplot(y, kde=False, fit=st.lognorm)
plt.hist(x_train['label'], orientation = 'vertical',histtype = 'bar', color ='red')
plt.show()

用pandas_profiling生成数据报告

import pandas_profiling
pfr = pandas_profiling.ProfileReport(x_train)
pfr.to_file("./data_analyse.html")
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值