机器学习笔记
文章平均质量分 57
paul_luo88
这个作者很懒,什么都没留下…
展开
-
机器学习笔记之决策树ID3
机器学习笔记之决策树 优点:计算复杂度不高,输出结果易于理解,对中间值的缺失不敏感,可以处理不相关特 征数据。 缺点:可能会产生过度匹配问题。 适用数据类型:数值型和标称型。 信息增益 划分数据集最大的原则是:将无序的数据变得更加有序。我们可以使用多种方法划分数据集,但是每种方法都有各自的优缺点。我们可以在划分数据之前使用信息论量化度量信息的内容。 在划分数据集之前之后信息发生的变化称为信息增益,...原创 2018-11-09 09:45:36 · 225 阅读 · 0 评论 -
机器学习笔记之Logistic回归
机器学习笔记之Logistic回归 基于 Logistic 回归和 Sigmoid 函数的分类 当x为0时,Sigmoid函数值为0.5。 随着x的增大,对应的Sigmoid值将逼近于1;而随着x的减小,Sigmoid值将逼近于0。 为了实现Logistic回归分类器,我们可以在每个特征上都乘以一个回归系数,然后把 所有的结果值相加,将这个总和代入Sigmoid函数中,进而得到一个范围在0~1之间...原创 2018-11-09 17:30:04 · 258 阅读 · 0 评论 -
机器学习笔记之K近邻算法
学习笔记之K近邻算法 算法概述 简单地说,k-近邻算法采用测量不同特征值之间的距离的方法进行分类。 算法优点:精度高、对异常值不敏感、无数据输入假定。 算法缺点:计算复杂度高、空间复杂度高。 适用数据范围:数值型和标称型。 工作原理: 存在一个样本数据集合,也称作训练样本集,并且样本集中每个数据都存在标签,即我们知道样本集中每一数据 与所属分类的对应关系。输入没有标签的新数据后,将新数据的每个特征...原创 2018-11-08 14:38:34 · 248 阅读 · 0 评论