层次聚类算法_【R语言】层次聚类算法及可视化

23020d38a9d448f9c2d1fe8749d23ab0.gif点击上方 蓝字  关注我们 ef3c46a0bf30a1a7495a99aacd9d01c1.png 07f9bdf2411c2dc30219d9522adb07e3.png
1000e619b18ad37afb31adc6daf7298d.png 1fecdcb251e9c599f66511ba0e8d0a45.png关于层次聚类层次聚类(Hierarchical Clustering)是一种和 K- 均值聚类类似的聚类算法。和 K-均值聚类不同的是,层次聚类不需要预先确定一个层次值;除此之外 ,层次聚类比 K-均值聚类更有优势的一点在于层次聚类的结果可以用树状图(dendrogram)来展示。

f22049c20a31ea9b6221adcdf4f62d10.png

1000e619b18ad37afb31adc6daf7298d.png 1fecdcb251e9c599f66511ba0e8d0a45.png准备工作

本节需要用到的 R 包:

# 加载包
library(dplyr)       # 数据预处理
library(ggplot2)     # 数据可视化
library(cluster)     # 实现聚类算法
library(factoextra)  # 聚类结果可视化

构建测试数据集(数据来自 R 包 AmesHousing):

# 数据预处理
ames_scale %
        select_if(is.numeric) %>%  # 选择数据类型为数字
        select(-Sale_Price) %>%    # 去除特定的数据
        mutate_all(as.double) %>%  # 强制转换类型
        scale()                    # 中心化标准化数据

层次聚类算法

层次聚类算法可以分成两种:

1. 聚集聚类(Agglomerative clustering),通常叫 AGNES,理解成从个体到整体的聚类方式;
2. 分裂层次聚类(Divisive h

  • 1
    点赞
  • 18
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值