【P19 机器学习-分类算法及应用实践】手写数字识别

R-G-B

已于 2023-07-24 21:20:23 修改

阅读量78

点赞数

分类专栏： Python 深度学习文章标签：机器学习分类 python

于 2022-06-26 16:44:24 首次发布

本文链接：https://blog.csdn.net/m0_51233386/article/details/125469329

版权

Python 同时被 2 个专栏收录

60 篇文章 3 订阅

订阅专栏

深度学习

51 篇文章 3 订阅

订阅专栏

手写字识别

1 手写字的识别（KNN）

在这里插入图片描述

1 手写字的识别（KNN）

通过0,1二值化把手写数字，变化成矩阵
32*32

在这里插入图片描述

1.1 读取训练集

在这里插入图片描述

import numpy as np 
from os import listdir  # 读取文件夹下的所有文件，形成一个文件列表

# 图片转矩阵
def img2vector(filename):
    returnVect = np.zeros((1,1024)) # 每个图片矩阵32*32，存为1行
    fr = open(filename)
    for i in range(32):
        lineStr = fr.readline()
        for j in range(32):
            returnVect[0,32*i+j] = int(lineStr[j])
    return returnVect

#读取数据
hwLabels = []
trainingFileList = listdir('E:\\Progarm\\Py_Program\\HandwritingRecognition\\trainingDigits')
m = len(trainingFileList)
trainingMat = np.zeros((m,1024))
for i in  range(m):
    fileNameStr=trainingFileList[i]
    fileStr = fileNameStr.split('.')[0]
    classNumStr = int(fileStr.split('_')[0])
    hwLabels.append(classNumStr)
    trainingMat[i,:] = img2vector('E:\\Progarm\\Py_Program\\HandwritingRecognition\\trainingDigits\\%s' % fileNameStr)

print(trainingFileList)
print(hwLabels)
print(trainingMat)

在这里插入图片描述

1.2 读取测试集

在这里插入图片描述

# 读取测试集,执行KNN分类
testFileList = listdir('E:\\Progarm\\Py_Program\\HandwritingRecognition\\testDigits')
k = 3
errorCount = 0.0
mTest = len(testFileList)
for i in range(mTest):
    fileNameStr = testFileList[i]
    fileStr = fileNameStr.split('.')[0]
    classNumStr = int(fileStr.split('_')[0])
    vectorUnderTest = img2vector('E:\\Progarm\\Py_Program\\HandwritingRecognition\\testDigits\\%s' % fileNameStr)
    classifierResult = K.knn(vectorUnderTest,trainingMat,hwLabels,k)
    print('KNN识别的结果是： %d , 实际是： %d' % (classifierResult,classNumStr))
    if classifierResult != classNumStr:
        errorCount +=1.0

print('训练集数量： %d ,测试集数量： %d' % (m,mTest))
print('错误识别数 : %d , 正确率 ： %f ' % (errorCount , (1-errorCount/float(mTest))*100))

在这里插入图片描述

1.3 完整程序

import numpy as np 
from os import listdir # 读取文件夹下的所有文件
import knn as K

# 图片转矩阵
def img2vector(filename):
    returnVect = np.zeros((1,1024)) # 每个图片矩阵32*32，存为1行
    fr = open(filename)
    for i in range(32):
        lineStr = fr.readline()
        for j in range(32):
            returnVect[0,32*i+j] = int(lineStr[j])
    return returnVect

#读取训练集数据
hwLabels = []
trainingFileList = listdir('E:\\Progarm\\Py_Program\\HandwritingRecognition\\trainingDigits')
m = len(trainingFileList)
trainingMat = np.zeros((m,1024))
for i in  range(m):
    fileNameStr = trainingFileList[i]
    fileStr = fileNameStr.split('.')[0]
    classNumStr = int(fileStr.split('_')[0])
    hwLabels.append(classNumStr)
    trainingMat[i,:] = img2vector('E:\\Progarm\\Py_Program\\HandwritingRecognition\\trainingDigits\\%s' % fileNameStr)


#print(trainingFileList)
#print(hwLabels)
#print(trainingMat)


# 读取测试集,执行KNN分类
testFileList = listdir('E:\\Progarm\\Py_Program\\HandwritingRecognition\\testDigits')
k = 3
errorCount = 0.0
mTest = len(testFileList)
for i in range(mTest):
    fileNameStr = testFileList[i]
    fileStr = fileNameStr.split('.')[0]
    classNumStr = int(fileStr.split('_')[0])
    vectorUnderTest = img2vector('E:\\Progarm\\Py_Program\\HandwritingRecognition\\testDigits\\%s' % fileNameStr)
    classifierResult = K.knn(vectorUnderTest,trainingMat,hwLabels,k)
    print('KNN识别的结果是： %d , 实际是： %d' % (classifierResult,classNumStr))
    if classifierResult != classNumStr:
        errorCount +=1.0
  
print('训练集数量： %d ,测试集数量： %d' % (m,mTest))
print('错误识别数 : %d , 正确率 ： %f ' % (errorCount , (1-errorCount/float(mTest))*100))