KNN算法,k 邻近(python)

1.原理
利用欧式距离计算各个特征的相似度,欧式距离越小,相似度越大。

2.代码:

from numpy import *
import operator
from os import listdir

def kNNClassify(inX, dataSet, labels, k):
    #sample size
    dataSize = dataSet.shape[0]
    #get the difference between inX and sample
    diffMat = tile(inX, (dataSize,1)) - dataSet
    diffMat = diffMat**2
    #get sum of each row so set axis = 1
    sumMat = diffMat.sum(axis = 1)
    sqdiffMat = sumMat**0.5
    #sort sqdiffMat and get the index result
    diffSortIndices = sqdiffMat.argsort()
    #res dict
    resLabels = {}
    maxTimes = 0
    for i range(k):
        tempLabel = labels[diffSortIndices[i]]
        resLabels[tempLabel] = resLabels.get(tempLabel, 0) + 1

    for key in resLabels.keys():
        if(resLabels.get(key) > maxTimes):
            maxTimes = resLabels.get(key)
            res = key
    return res 
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值