在moon数据集上对三种聚类方法进行性能对比

本文对比了k均值、凝聚聚类和DBSCAN在moon数据集上的性能,通过调整rand指数(ARI)和轮廓分数进行评估。结果显示DBSCAN在ARI上表现最佳,揭示了其在复杂形状聚类的优势。然而,即使有高评分,仍需人工分析以确保聚类的语义含义。
摘要由CSDN通过智能技术生成

在有真实值的情况下对聚类算法性能对比

有一些指标可用于评估聚类算法相对于真实聚类的结果,其中最重要的是调整 rand 指数(adjusted rand index,ARI)和归一化互信息(normalized mutual information, NMI),二者都给出了定量的度量,其最佳值为 1,0 表示不相关的聚类(虽然 ARI 可以取负值)。下面我们使用 ARI 来比较 k 均值、凝聚聚类和 DBSCAN 算法。
注意,不能使用之前评估监督学习算法的Accuracy Score来评估聚类算法,因为聚类算法的结果不具有先验性。

#计算调整rand指数ARI
from sklearn.metrics.cluster import adjusted_rand_score
from sklearn.preprocessing import StandardScaler
from sklearn.datasets import make_moons
import matplotlib.pyplot as plt
import numpy as np

X, y = make_moons(n_samples=200, noise=0.05, random_state=0)
# 将数据缩放成平均值为0、方差为1
scaler = StandardScaler()
scaler.fit(X)
X_scaled = scaler.transform(X)
fig, axes = plt.subplots(1, 4, figsize=(15, 3),
 subplot_kw={
   'xticks': (), 'yticks': ()})
# 列出要使用的算法
from sklearn.cluster import DBSCAN, KMeans
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值