各聚类算法比较

本文探讨了聚类的主要类型,包括基于划分、层次、密度和网格的方法,并列举了各自的代表算法,如K-MEANS、BIRCH、DBSCAN等,强调了不同算法的特点和适用场景。
摘要由CSDN通过智能技术生成

聚类的目标是使同一类对象的相似度尽可能地大;不同类对象之间的相似度尽可能地小。

1.基于划分:给定一个有N个元组或者纪录的数据集,分裂法将构造K个分组,每一个分组就代表一个聚类,K<N。

特点:计算量大。很适合发现中小规模的数据库中小规模的数据库中的球状簇。

算法:K-MEANS算法、K-MEDOIDS算法、CLARANS算法


2.基于层次:对给定的数据集进行层次似的分解,直到某种条件满足为止。具体又可分为“自底向上”和“自顶向下”两种方案。

特点:较小的计算开销。然而这种技术不能更正错误的决定。

算法:BIRCH算法、CURE算法、CHAMELEON算法


3.基于密度:只要一个区域中的点的密度大过某个阈值,就把它加到与之相近的聚类中去。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值