- 博客(1)
- 收藏
- 关注
原创 数据挖掘中常用的数据清洗方法
在数据挖掘过程中,数据清洗主要根据探索性分析后得到的一些结论入手,然后主要对四类异常数据进行处理;分别是缺失值(missing value),异常值(离群点),去重处理(Duplicate Data)以及噪音数据的处理。 1. 探索性分析探索性分析部分,对于整个数据来讲是获得对数据一个初步的认识以及对先验知识的一个探索分析过程,在我做相关数据挖掘的过程中,主要是利用python相关的科学计算库进行...
2018-05-15 14:16:15 56367 3
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人