K-means聚类及其验证

最新推荐文章于 2024-08-11 16:00:02 发布

lynne233

最新推荐文章于 2024-08-11 16:00:02 发布

阅读量7.6k

点赞数

分类专栏：机器学习

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/lion19930924/article/details/52921999

版权

机器学习专栏收录该内容

19 篇文章 0 订阅

订阅专栏

给定D维空间上的数据集，并不知道这些数据集所对应的类型和标号，通过聚类方法将这些数据集划分成K类。K-means聚类是一种无监督模式的学习。

聚类的原则就是使准则函数最小：

聚类的验证有多种方式，通常较通用的应该一定都会有Entropy 熵和 Accuracy, （Accuracy 里可以包含了precision, recall, f-measure.）假设我们使用k-means算法，通常会加上SSE （Sum of squared errors）平方误差和，其他算法会有不同指标。总体思想为一个cluster聚类内的数据点聚集在一起的密度越高，圈子越小，离centroid中心点越近，那么这个聚类的总体质量相对来说就会越好。

SSE的计算如下：

关注

0
点赞
踩
13

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。