文本聚类分析算法_集成聚类系列（三）图聚类算法详解

最新推荐文章于 2023-06-01 13:54:44 发布

weixin_39673947

最新推荐文章于 2023-06-01 13:54:44 发布

阅读量916

点赞数

文章标签：文本聚类分析算法

图聚类算法研究现状

聚类分析是一种常用的机器学习技术，它的目的是将一个数据点划分为几个类。同一个类的数据之间具有较高的相似性，不同的类之间的相似度较低。

很多研究已表明图聚类是一种极具竞争力的聚类算法，图聚类是一种基于图划分理论的算法。与其他聚类算法相比，图聚类算法有些明显的优势。该方法可识别任意形状的聚类，使其在现实生活中得到广泛的应用。目前，在许多领域都成功地运用了图聚类算法，比如文本挖掘，网页划分，图像分割，视频分割，语音识别等

对图聚类算法仍处于初始阶段，还存在一些值得进一步研究的问题。尤其是以下方面：

如何选择合适的相似度矩阵，相似度矩阵的差异会对图聚类的性能有影响
真实数据的大部分数据是无标签数据，只有少部分数据是存在标签的，如何利用少量标签引导聚类
图聚类的计算时间复杂度比较高
如何自动确定聚类个数k,减少调参数的困扰

图聚类源于图划分理论，是近年来较为流行的聚类算法，图聚类算法的核心是将聚类问题看成图分割问题，并将图分割这个NP难问题，通过连续松弛化求解。本章研究涉及图聚类算法的三个相关技术：图划分理论，双随机矩阵，乘性更新。

图划分理论

图的$Laplacian$矩阵

对于邻接矩A,定义图G中子图a与子图b之间所有权的权值之和如下：

其中A_{i j}定义数据点i,j之间的权重。定义与数据点i相连的所有边权值之和为度d_{i},全部度构成度向量D:

构建拉普拉斯矩阵 L=D-A

别着急，下面我们来举个例子，看下拉普拉斯矩阵构建的过程。假设现在有6个数据点，如下图分布(可以是二维原始数据，也可以是基于某种相似规则计算了数据间的相似度量后所呈现的关联)

最低0.47元/天解锁文章

weixin_39673947

关注

0
点赞
踩
2

收藏

觉得还不错? 一键收藏
0
评论
文本聚类分析算法_集成聚类系列（三）图聚类算法详解

图聚类算法研究现状聚类分析是一种常用的机器学习技术，它的目的是将一个数据点划分为几个类。同一个类的数据之间具有较高的相似性，不同的类之间的相似度较低。很多研究已表明图聚类是一种极具竞争力的聚类算法，图聚类是一种基于图划分理论的算法。与其他聚类算法相比，图聚类算法有些明显的优势。该方法可识别任意形状的聚类，使其在现实生活中得到广泛的应用。目前，在许多领域都成功地运用了图聚类算法，比如文本挖掘，网页划...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。