机器学习实战:kNN(k-近邻算法)

一、算法介绍

  • 监督学习算法
  • 分类算法
  • 查找与已有数据中最接近的k个类别,分类为出现类别最大概率的类别

二、一般流程:

三、代码实现:

python3中已经废弃iteritems()函数,使用会报错:

关键代码如下:

def classify0(inX,dataSet,labels,k):
    dataSetSize = dataSet.shape[0]
    print('dataSetSize:')
    print(dataSetSize)
    diffMat=tile(inX,(dataSetSize,1))-dataSet
    print('diffMat:')
    print(diffMat)
    sqDiffMat=diffMat**2
    print('sqDiffMat:')
    print(sqDiffMat)
    sqDistances=sqDiffMat.sum(axis=1)
    print('sqDistances:')
    print(sqDistances)
    distances=sqDistances**0.5
    print('distances:')
    print(distances)
    sortedDistIndicies=distances.argsort()
    print('sortedDistIndicies:')
    print(sortedDistIndicies)
    classCount={}
    
    for i in range(k):
        voteIlabel=labels[sortedDistIndicies[i]]
        classCount[voteIlabel]=classCount.get(voteIlabel,0)+1
        
    print('classCount:')
    print(classCount)
    
    sortedClassCount=sorted(classCount.items(),key=operator.itemgetter(1),reverse=True)
    
    print('sortedClassCount:')
    print(sortedClassCount)
    return sortedClassCount[0][0]
    

使用Anaconda Navigator集成的JupyterLab软件运行:

传入参数,请求结果为:

 

详细问题可参考:

1.Python3字典中items()和python2.x中iteritems()有什么区别

2. Python 字典(Dictionary) get()方法

3. numpy中argsort函数用法

4. 【python系列】numpy中的tile函数

5. 机器学习实战k-邻近算法(kNN)简单实施代码解读

 

 

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值