决策树的基本原理--学习于实验楼，顺利通过阿里面试

最新推荐文章于 2024-06-14 14:24:42 发布

2401_84091289

最新推荐文章于 2024-06-14 14:24:42 发布

阅读量810

点赞数 6

分类专栏：程序员文章标签：决策树学习面试

本文链接：https://blog.csdn.net/2401_84091289/article/details/137401530

版权

程序员专栏收录该内容

302 篇文章 0 订阅

订阅专栏

决策树可以用来解决分类或者回归问题，分别称之为分类树或回归树。其中，分类树的输出是一个标量。而回归树的输出一般为一个实数

通常情况下，决策树利用损失函数最小的原则建立模型，然后利用该模型进行预测。决策树学习通常包含三个阶段：特征选择，树的生成，树的修剪。

三个阶段

特征选择

特征选择是建立决策树之前的十分重要的一步。如果是随机的选择特征，那么所建立决策树的学习效率就会大打折扣。举例：银行采用决策树来解决信用卡审批问题，判断是否向某人发放信用卡可以根据其年龄，工作单位，是否有不动产，历史信贷情况等特征决定。而选择不同的特征，后续生成的决策树就会不一致，这种不一致最终会影响到决策树的分类效率。

通常我们在选择特征的时, 会考虑到两种不同的指标，分别为：信息增益和信息增益比。这里就要谈到信息论中的另一个常见的名词:熵。

熵（Entropy）是表示随机变量不确定性的度量。简单来说：熵越大，随机变量的不确定性就越大，而特征A对于某一训练集D的信息增益g(D,A)定义为集合D的熵H(D)与特征A在给定条件下D的熵的（H|A）之差。

g(D,A)=H(D)-H(D|A)

简单来讲，每一个特征针对训练数据集的前后信息变化的影响是不一样的，信息增益越大，即代表这种影响越大，而影响越大，就表明该特征更加重要。

生成算法

决策树的生成算法最经典的就数 John Ross Quinlan 提出的 ID3 算法，这个算法的核心理论即源于上面提到的信息增益。

ID3 算法通过递归的方式建立决策树。建立时，从根节点开始，对节点计算每个独立特征的信息增益，选择信息增益最大的特征作为节点特征。接下来，对该特征施加判断条件，建立子节点。然后针对子节点再此使用信息增益进行判断，直到所有特征的信息增益很小或者没有特征时结束，这样就逐步建立一颗完整的决策树。

除了从信息增益演化而来的 ID3 算法，还有一种常见的算法叫 C4.5。C4.5 算法同样由 John Ross Quinlan 发明，但它使用了信息增益比来选择特征，这被看成是 ID3 算法的一种改进。

ID3 和 C4.5 算法简单高效，但是他俩均存在一个缺点，那就是用 “完美去造就了另一个不完美”。这两个算法从信息增益和信息增益比开始，对整个训练集进行的分类，拟合出来的模型针对该训练集的确是非常完美的。但是，这种完美就使得整体模型的复杂度较高，而对其他数据集的预测能力就降低了，也就是我们常说的过拟合而使得模型的泛化能力变弱。
自我介绍一下，小编13年上海交大毕业，曾经在小公司待过，也去过华为、OPPO等大厂，18年进入阿里一直到现在。

深知大多数前端工程师，想要提升技能，往往是自己摸索成长或者是报班学习，但对于培训机构动则几千的学费，着实压力不小。自己不成体系的自学效果低效又漫长，而且极易碰到天花板技术停滞不前！

因此收集整理了一份《2024年Web前端开发全套学习资料》，初衷也很简单，就是希望能够帮助到想自学提升又不知道该从何学起的朋友，同时减轻大家的负担。

既有适合小白学习的零基础资料，也有适合3年以上经验的小伙伴深入学习提升的进阶课程，基本涵盖了95%以上前端开发知识点，真正体系化！

由于文件比较大，这里只是将部分目录截图出来，每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频，并且会持续更新！

如果你觉得这些内容对你有帮助，可以扫码获取！！（备注：前端）

最后

资料过多，篇幅有限，需要文中全部资料可以点击这里免费获取前端面试资料PDF完整版！

自古成功在尝试。不尝试永远都不会成功。勇敢的尝试是成功的一半。

/bbs.csdn.net/topics/618191877)前端面试资料PDF完整版！**

自古成功在尝试。不尝试永远都不会成功。勇敢的尝试是成功的一半。

2401_84091289

关注

6
点赞
踩
15

收藏

觉得还不错? 一键收藏
0
评论
决策树的基本原理--学习于实验楼，顺利通过阿里面试

资料过多，篇幅有限，需要文中全部资料可以点击这里免费获取前端面试资料PDF完整版！自古成功在尝试。不尝试永远都不会成功。勇敢的尝试是成功的一半。/bbs.csdn.net/topics/618191877)前端面试资料PDF完整版！**自古成功在尝试。不尝试永远都不会成功。勇敢的尝试是成功的一半。
复制链接

扫一扫