knn算法的原理和实现流程及在sklearn中调用knn算法

knn算法的原理和实现流程

import numpy as np
from matplotlib import pyplot as plt

raw_data_X = [[3.3935, 2.3312],
              [3.1101, 1.7815],
              [1.3438, 3.3684],
              [3.5823, 4.6792],
              [2.2804, 2.8670],
              [7.4234, 4.6965],
              [5.7451, 3.5340],
              [9.1722, 2.5111],
              [7.7928, 3.4241],
              [7.9398, 0.7916]]
raw_data_y =[0, 0, 0, 0, 0, 1, 1, 1, 1, 1]  #  0代表良性肿瘤,1代表恶性肿瘤

X_train = np.array(raw_data_X)
y_train = np.array(raw_data_y)
# X_train.shape
# y_train.shape

plt.scatter(X_train[y_train==0,0],X_train[y_train==0,1],color='r')
plt.scatter(X_train[y_train==1,0],X_train[y_train==1,1],color='b')
plt.show()

在这里插入图片描述

# 给定待预测数据,预测他的结果
x = np.array([8.0936, 3.3657])
plt.scatter(X_train[y_train==0,0],X_train[y_train==0,1],color='r')
plt.scatter(X_train[y_train==1,0],X_train[y_train==1,1],color='b')
plt.scatter(x[0],x[1],color='g')
plt.show()

在这里插入图片描述

# 计算每一个点到绿色点的距离
from math import sqrt
distance = []  # 保存和其他所有点的距离
for x_train in X_train:
    """方法一,适用于二维"""
    distance.append(sqrt((x_train[0]-x[0])**2+(x_train[1]-x[1])**2))
    """方法二,适用于多维"""
#     distance.append(sqrt(np.sum((x_train-x)**2)))
    
"""方法三,列表生成式"""
# distance = [sqrt(np.sum((x_train-x)**2)) for x_train in X_train]

#  找出离待预测的点距离最近的k个点
k = 3
nearest = np.argsort(distance)

# 找出最近的k个点下标值以后,找出这些样本对应的目标值
y_train[nearest]

top_K = [i for i in y_train[nearest]]

# 计算投票结果
from collections import Counter
votes = Counter(top_K)

# 其他的计票方法
votes_test = Counter([1,1,0,2,2,2]) # 传入一个列表
votes_test

y_predict = votes.most_common(1)[0][0]

在sklearn中调用knn算法

from sklearn.neighbors import KNeighborsClassifier
import numpy as np

knn_clf = KNeighborsClassifier()

raw_data_X = [[3.3935, 2.3312],
              [3.1101, 1.7815],
              [1.3438, 3.3684],
              [3.5823, 4.6792],
              [2.2804, 2.8670],
              [7.4234, 4.6965],
              [5.7451, 3.5340],
              [9.1722, 2.5111],
              [7.7928, 3.4241],
              [7.9398, 0.7916]]
raw_data_y =[0, 0, 0, 0, 0, 1, 1, 1, 1, 1]  #  0代表良性肿瘤,1代表恶性肿瘤
X_train = np.array(raw_data_X)
y_train = np.array(raw_data_y)

knn_clf.fit(X_train,y_train)

x = np.array([8.0936, 3.3657]).reshape(1,-1)
knn_clf.predict(x)
  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值