数据挖掘学习(一)

数据挖掘:从大量数据中抽取出(隐含的、有潜在用途的、未知的、人们可以理解的)有价值的信息和模式的过程。

步骤:1. 学习应用领域(应用的相关先验知识和目标)

           2. 创建目标数据集:数据选择

           3. 数据清理和预处理

           4. 数据简化和变形

           5. 选择数据挖掘功能

           6. 选择数据挖掘算法

           7. 数据挖掘:寻找有趣的模式

           8. 模式评估和知识展示

           9. 知识发现的使用

方法:1. 关联规则:购物篮分析,药品关联

           2. 分类:将信用卡申请者按风险等级分为高,中,低。

           3. 预测

           4. 聚类:分组,组内对象相似,组间不同,划分依据为相似性度量

                          类标签是未知的,最大化内部类的相似性和最小化 阶级之间的相似性

                          无指导性学习


  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值