python kmeans聚类调参_python系列之手写k-means(k均值)聚类算法

k-means是一种无监督学习聚类算法,其方法通俗易懂,易于实现,以下将对算法原理进行介绍并用python实现。

1.k-means原理

k均值算法的计算过程非常直观:

1.根据数据集dataSet各列的最大最小值随机生产k个元素,作为k个簇的各自的中心;

2.分别计算剩下的元素到k个簇中心的相异度,将这些元素分别划归到相异度最低的簇;

3.根据聚类结果,重新计算k个簇各自的中心,计算方法是取簇中所有元素各自维度的算术平均数;

4.将dataSet中全部元素按照新的中心重新聚类;

5.重复第4步,直到聚类结果不再变化;

6.将结果输出。

2.算法优缺点

优点在于:

1.原理通俗易懂,实现方便,收敛速度快;

2.聚类效果较优,可解释性较强;

3.调参只需要改变k值。

缺点在于:

1.k值难以确定;

2.大规模数据收敛较慢;

3.采用的是迭代的方法,只能得到局部最优解;

4.对异常值较敏感。

3.python代码实现

#pyhton3.6

#随机生成聚类中心函数

from numpy import *

from pandas import *

def randomCenters(dataSet,k):

n = shape(dataSet)[1]

centers = mat(zeros

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值