2_3最近邻算法kNN(k_nearest_neighbor)——autoNorm_2_3

声明:《机器学习实战》代码详细注释和重构,以及相关的函数、模块和算法的解释;本文为博主原创文章,未经博主允许不得转载。

1.归一化特征值(程序清单2-3)
*#代码:Peter Gong_shuai
*#中文注释:Gong_shuai
*#代码重构:Gong_shuai
*#函数注解:Gong_shuai
*#相关的函数、模块和算法的解释:Gong_shuai
*#环境:Python2.7、Sublime Text3、mac

  1. 代码
#coding=utf-8
#归一化特征值(程序清单2-3)

#源代码:Peter  Gong_shuai
#中文注释:Gong_shuai
#代码重构:Gong_shuai
#函数注解:Gong_shuai
#环境:python2.7


from numpy import * 



#处理输入格式问题,输入为文件名字符串,输出为训练样本矩阵和类标签向量
def file2matrix(filename):
    fr = open(filename)
    numberOfLines = len(fr.readlines())         #得到文本行数
    returnMat = zeros((numberOfLines,3))        #创建以零填充的矩阵,为了简化,另外的一个维度设为3
    classLabelVector = []                       #返回标签     
    fr = open(filename)    #解析文件数据到列表,循环处理文件中的每一行的数据
    index = 0
    for line in fr.readlines():
        line = line.strip()    #截取掉所有的回车字符
        listFromLine = line.split('\t')    #将整行数据分割成一个元素列表
        returnMat[index,:] = listFromLine[0:3]     #选取前三个元素,存储到特征矩阵中
        classLabelVector.append(int(listFromLine[-1]))
        index += 1
    return returnMat,classLabelVector


#归一化特征值    
def autoNorm(dataSet):
    minVals = dataSet.min(0)#每一列的最小值
    maxVals = dataSet.max(0)#每一列的最大值
    ranges = maxVals - minVals
    normDataSet = zeros(shape(dataSet))
    m = dataSet.shape[0]#数组的大小  
    normDataSet = dataSet - tile(minVals, (m,1))#注意事项:特征值矩阵有1000*3个值。而minVals和range的值都为1*3.为了解决这个问题使用numpy中tile函数将变量内容复制成输入矩阵同样大小的矩阵  
    normDataSet = normDataSet/tile(ranges, (m,1))   #element wise divide矩阵除法
    return normDataSet, ranges, minVals

datingDataMat,datingLabels = file2matrix('datingTestSet2.txt')#读取文件数据

normMat, ranges, minVals = autoNorm(datingDataMat)
print(normMat)
print(ranges)
print(minVals)
  1. 运行结果
    这里写图片描述
  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值