- 博客(2)
- 资源 (4)
- 收藏
- 关注
原创 机器学习实战学习笔记(二):决策树
决策树优缺点 优点:计算复杂度不高,输出结果易于理解,对中间值的确实不敏感,可以处理不相关特征数据。 缺点:可能会产生过度匹配问题。 适用数据类型:数值型和标称型。 原理树结构信息增益在划分数据集之前之后信息发生的变化称为信息增益。香农商集合信息的度量方式称为香农熵或者简称为熵,这个名字来源于信息论之父克劳德.香农。例子略实际中的应用——预测隐形眼镜类型隐形眼镜数据集是非常著名的数据集。构造树结构。
2017-03-22 13:30:38 285
原创 机器学习实战学习笔记(一):K-近邻算法
K-近邻算法优缺点 K-近邻算法采用测量不同特征值之间的距离方法进行分类。优点:精度高、对异常值不敏感、无数据输入假定。 缺点:计算复杂度高、空间复杂度高。 适用数据范围:数值型和标称型。 原理存在一个样本数据集合,也称作训练样本集,并且样本集中每个数据都存在标签,即我们知道样本集中每一数据与所属分类的对应关系。输入没有标签的新数据后,将新数据的每个特征和样本集中数据对应的特征进行比较,然后算法
2017-03-20 21:40:52 261
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人