R语言学习笔记之聚类分析

最新推荐文章于 2024-03-08 09:30:19 发布

R语言中文社区

最新推荐文章于 2024-03-08 09:30:19 发布

阅读量5.7k

点赞数 3

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/kMD8d5R/article/details/79081683

版权

本文是R语言爱好者taoyan的学习笔记，主要探讨R语言中的聚类分析技术，包括数据预处理、不同聚类算法的实现及应用，旨在帮助读者深入理解并掌握聚类分析在实际问题中的应用。

摘要由CSDN通过智能技术生成

引导关注

作者简介Introduction

taoyan：伪码农，R语言爱好者，爱开源。

个人博客: https://ytlogos.github.io/

欧式古典分割线

使用k-means聚类所需的包：

factoextra
cluster #加载包

library(factoextra)

library(cluster)l

#数据准备
使用内置的R数据集USArrests

#load the dataset

data("USArrests")

#remove any missing value (i.e, NA values for not available)

#That might be present in the data

USArrests <- na.omit(USArrests)#view the first 6 rows of the data

head(USArrests, n=6)

在此数据集中，列是变量，行是观测值
在聚类之前我们可以先进行一些必要的数据检查即数据描述性统计，如平均值、标准差等

desc_stats <- data.frame( Min=apply(USArrests, 2, min),#minimum

Med=apply(USArrests, 2, median),#median

Mean=apply(USArrests, 2, mean),#mean

SD=apply(USArrests, 2, sd),#Standard deviation

Max=apply(USArrests, 2, max)#maximum

)

最低0.47元/天解锁文章

R语言中文社区

关注

3
点赞
踩
38

收藏

觉得还不错? 一键收藏
0
评论
R语言学习笔记之聚类分析

作者简介Introductiontaoyan：伪码农，R语言爱好者，爱开源。个人博客: https://ytlogos.github.io/使用k-means聚类所需的包：factoextracluster #加载包library(factoextra)library(cluster)l #数据准备使用内置的R数据集USArrests#load the datasetdata("USArrests
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。