K-近邻算法
K-近邻算法
通过计算目标数据数据到训练数据地距离,根据距离的排序,选择排名靠前的几个训练数据类型,投票决定预测类型
优点
精度高,对异常值不敏感,无数据输入假定
缺点
计算复杂度较高,空间复杂度高
适用范围
数值型数据和标称型数据
一般流程
- 收集数据
- 准备数据:距离计算所需数值,最好是结构化的数据格式
- 分析数据
- 训练算法:该步骤不适用于K-近邻算法
- 测试算法:计算算法的错误率
- 使用算法:
- 首先需要输入样本数据和结构化的输出结果
- 然后运行K-近邻算法判定输入数据分别属于哪个分类
- 最后对算出的分类执行后续的处理