数据挖掘算法之-关联规则挖掘(Association Rule)(购物篮分析)

关联规则挖掘是数据挖掘的一种方法,用于发现数据中隐藏的有趣关系。本文介绍了关联规则的置信度、支持度、期望可信度和提升度等概念,并通过实例解释了它们的含义。Apriori算法作为一种经典的挖掘算法,存在候选集生成过多的问题,而FP-树频集算法则解决了这一问题,提高了效率。
摘要由CSDN通过智能技术生成
在各种数据挖掘算法中,关联规则挖掘算是比较重要的一种,尤其是受购物篮分析的影响,关联规则被应用到很多实际业务中,本文对关联规则挖掘做一个小的总结。
首先,和聚类算法一样,关联规则挖掘属于无监督学习方法,它描述的是在一个事物中物品间同时出现的规律的知识模式,现实生活中,比如超市购物时,顾客购买记录常常隐含着很多关联规则,比如购买圆珠笔的顾客中有65%也购买了笔记本,利用这些规则,商场人员可以很好的规划商品摆放问题;
为叙述方便,设R= { I1,I2 ......Im} 是一组物品集,W 是一组事务集。W 中的每个事务T 是一组物品,T是R的子集。假设有一个物品集A,一个事务T关联规则是如下形式的一种蕴含:AB,其中A、B 是两组物品,A属于I子集B属于I子集
在关联规则中设计4个常用关键指标
1.置信度(confidence)
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值