K-Nearest Neighbor 最邻近分类算法:
简称KNN,最简单的机器学习算法之一,核心思想俗称“随大流”。是一种分类算法,基于实例的学习(instance-based learning)和懒惰学习(lazy learning)。
懒惰学习:指的是
在训练是仅仅是保存样本集的信息,直到测试样本到达是才进行分类决策。
核心想法:
在距离空间里,如果一个样本的最接近的k个邻居里,绝大多数属于某个类别,则该样本也属于这个类别。
范例:
假设,我们有这样一组电影数据: