算法流程:
1,选择聚类的个数K.
2,任意产生K个聚类,然后确定聚类中心,或者直接生成K个中心。
3,对每个点确定其聚类新中心。
4,再计算其聚类新中心。
5.重复以上步骤直到满足收敛要求。(通常就是确定的中心点不再改变。)
K-means:
事先确定常数K,常数K意味着最终的聚类类别数,首先随机选定初始点为质心,并通过计算每一个样本与质心之间的相似度(这里为欧式距离),将样本点归到最相似的类中,接着,重新计算每个类别的质心(极为类中心),重复这样的过程,直到质心不再改变,最终就确定 了每个样本所属的类别以及每个类的质心。由于每次都要计算所有的样本与每一个质心之间的相似度,故在大规模的数据集上,K-means算法的收敛速度比较慢。