使用K-Means算法对微信背景图进行分割

最新推荐文章于 2024-07-11 13:52:29 发布

喜欢大海的CC

最新推荐文章于 2024-07-11 13:52:29 发布

阅读量777

点赞数

分类专栏：数据分析文章标签：聚类算法 python

本文链接：https://blog.csdn.net/weixin_45145550/article/details/112769179

版权

数据分析专栏收录该内容

8 篇文章 4 订阅

订阅专栏

K-Means 是一种非监督学习，解决的是聚类问题。K 代表的是 K 类，Means 代表的是中心，你可以理解这个算法的本质是确定 K 类的中心点，当你找到了这些中心点，也就完成了聚类。

(一)工作原理
1、选取 K 个点作为初始的类中心点，这些点一般都是从数据集中随机抽取的；
2、将每个点分配到最近的类中心点，这样就形成了 K 个类，然后重新计算每个类的中心点；
3、重复第二步，直到类不发生变化，或者你也可以设置最大迭代次数，这样即使类中心点发生变化，但是只要达到最大迭代次数就会结束。
(二)区分K-Means算法和KNN算法
1、这两个算法解决数据挖掘的两类问题，K-Means 是聚类算法，KNN 是分类算法。
2、这两个算法分别是两种不同的学习方式，K-Means 是非监督学习，也就是不需要事先给出分类标签，而 KNN 是有监督学习，需要我们给出训练数据的分类标识。
3、K 值的含义不同，K-Means 中的 K 值代表 K 类，KNN 中的 K 值代表 K 个最接近的邻居。
(三)实战——分割微信背景图
图像分割就是利用图像自身的信息，比如颜色、纹理、形状等特征进行划分，将图像分割成不同的区域，划分出来的每个区域就相当于是对图像中的像素进行了聚类。单个区域内的像素之间的相似度大，不同区域间的像素差异性大。这个特性正好符合聚类的特性，所以可以把图像分割看成是将图像中的信息进行聚类。当然聚类只是分割图像的一种方式，除了聚类，我们还可以基于图像颜色的阈值进行分割，或者基于图像边缘的信息进行分割等。
在这里插入图片描述
1、数据获取
因为 jpg 格式的图像是三个通道 (R,G,B)，也就是一个像素点具有 3 个特征值。这里我们用 c1、c2、c3 来获取平面坐标点 (x,y) 的三个特征值，特征值是在 0-255 之间；为了加快聚类的收敛，我们需要采用 Min-Max 规范化对数据进行规范化。

# 加载图像，并对数据进行规范化
def load_data(filePath):
    # 读文件
    f = open(filePath,'rb')
    data = []
    # 得到图像的像素值
    img = image.open(f)
    # 得到图像尺寸
    width, height = img.size
    for x in range(width):
        for y in range(height):
            # 得到点(x,y)的三个通道值
            c1, c2, c3 = img.getpixel((x, y))
            data.append([c1, c2, c3])
    f.close()
    # 采用Min-Max规范化
    mm = preprocessing.MinMaxScaler()
    data = mm.fit_transform(data)
    return np.mat(data), width, height

2、2聚类

import PIL.Image as image

# 加载图像，得到规范化的结果img，以及图像尺寸
img, width, height = load_data('C:/Users/1/Downloads/kmeans-master/kmeans-master/weixin.jpg')

# 用K-Means对图像进行2聚类
kmeans =KMeans(n_clusters=2)
kmeans.fit(img)
label = kmeans.predict(img)
# 将图像聚类结果，转化成图像尺寸的矩阵
label = label.reshape([width, height])
# 创建个新图像pic_mark，用来保存图像聚类的结果，并设置不同的灰度值
pic_mark = image.new("L", (width, height))
for x in range(width):
    for y in range(height):
        # 根据类别设置图像灰度, 类别0 灰度值为255， 类别1 灰度值为127
        pic_mark.putpixel((x, y), int(256/(label[x][y]+1))-1)
pic_mark.save("C:/Users/1/Downloads/kmeans-master/kmeans-master/weixin_mark.jpg", "JPEG")

运行结果：
在这里插入图片描述

3、16聚类

import PIL.Image as image

# 加载图像，得到规范化的结果img，以及图像尺寸
img, width, height = load_data('C:/Users/1/Downloads/kmeans-master/kmeans-master/weixin.jpg')

# 用K-Means对图像进行16聚类
kmeans =KMeans(n_clusters=16)
kmeans.fit(img)
label = kmeans.predict(img)
# 将图像聚类结果，转化成图像尺寸的矩阵
label = label.reshape([width, height])

from skimage import color
# 将聚类标识矩阵转化为不同颜色的矩阵
label_color = (color.label2rgb(label)*255).astype(np.uint8)
label_color = label_color.transpose(1,0,2)
#通过矩阵生成图片
images = image.fromarray(label_color)
images.save('C:/Users/1/Downloads/kmeans-master/kmeans-master/weixin_mark_color.jpg')

运行结果：
在这里插入图片描述

4、得到原图

# -*- coding: utf-8 -*-
# 使用K-means对图像进行聚类，并显示聚类压缩后的图像
import numpy as np
import PIL.Image as image
from sklearn.cluster import KMeans
from sklearn import preprocessing
import matplotlib.image as mpimg
# 加载图像，并对数据进行规范化
def load_data(filePath):
    # 读文件
    f = open(filePath,'rb')
    data = []
    # 得到图像的像素值
    img = image.open(f)
    # 得到图像尺寸
    width, height = img.size
    for x in range(width):
        for y in range(height):
            # 得到点(x,y)的三个通道值
            c1, c2, c3 = img.getpixel((x, y))
            data.append([(c1+1)/256.0, (c2+1)/256.0, (c3+1)/256.0])
    f.close()
    return np.mat(data), width, height
# 加载图像，得到规范化的结果imgData，以及图像尺寸
img, width, height = load_data('C:/Users/1/Downloads/kmeans-master/kmeans-master/weixin.jpg')
# 用K-Means对图像进行16聚类
kmeans =KMeans(n_clusters=16)
label = kmeans.fit_predict(img)
# 将图像聚类结果，转化成图像尺寸的矩阵
label = label.reshape([width, height])
# 创建个新图像img，用来保存图像聚类压缩后的结果
img=image.new('RGB', (width, height))
for x in range(width):
    for y in range(height):
    	#对于点 (x,y)，我们找到它们所属的簇 label[x,y]，然后得到这个簇的质心特征，用 c1,c2,c3 表示
        c1 = kmeans.cluster_centers_[label[x, y], 0]
        c2 = kmeans.cluster_centers_[label[x, y], 1]
        c3 = kmeans.cluster_centers_[label[x, y], 2]
        # c1, c2, c3 对应的是数据规范化的数值，因此我们还需要进行反变换
        img.putpixel((x, y), (int(c1*256)-1, int(c2*256)-1, int(c3*256)-1))
img.save('C:/Users/1/Downloads/kmeans-master/kmeans-master/weixin_new.jpg')