聚类任务基础详解

本文详细介绍了聚类任务的基础知识,包括聚类的定义、性能度量的外部指标和内部指标,以及如何计算有序属性、无序属性和混合距离。通过理解这些概念,有助于更好地进行聚类算法的学习和应用。
摘要由CSDN通过智能技术生成

前言

本篇博客将详解聚类的基础内容,为之后的几种聚类算法做铺垫。
本文中图片来自自己的PPT或者百度百科,没有剽窃,没有剽窃,没有剽窃!

聚类任务

聚类属于无监督学习。再无监督学习中,训练样本是没有标记的,目标通过对训练样本的学习来揭示数据的内在规律,性质,为进一步的数据分析提供基础,而聚类是其中研究最多,引用最广的。
聚类的任务:聚类试图将数据集中的样本,划分为若干个(通常是)不相交的子集,而这每个子集称之为簇,通过这样的划分之后,每个子集可能会对应一个潜在的概念,或者说对应一个类。这些概念聚类算法是不知道的,需要使用者对其进行命名。
从集合的角度来看,我们可以直观的看图:
在这里插入图片描述
将一个集合D(样本空间包含m个样本)划分为N个(通常)不相交的子集,每个子集中包含了若干个样本,而每个样本有自己的簇标记,聚类的结果最终可用一个包含了m个元素的簇标记向量来表示,如下:
在这里插入图片描述

聚类的两个基本问题

  • 2
    点赞
  • 5
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值