简述随机森林（RF）和梯度提升决策树（GBDT）的区别

最新推荐文章于 2025-03-29 15:51:17 发布

一摩尔自由

最新推荐文章于 2025-03-29 15:51:17 发布

阅读量1.5w

点赞数 6

分类专栏：机器学习 python 机器学习算法篇

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/Barry_J/article/details/81938402

版权

本文对比了随机森林和梯度提升决策树（GBDT）两种基于决策树的算法。随机森林通过随机样本和特征选择，降低过拟合风险，而GBDT采用boosting策略，每次迭代优化前一轮的残差。随机森林采用投票决定分类，GBDT则沿着梯度下降方向构建弱学习器。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

决策树
决策树是机器学习中常用到的一种分类与回归方法，由节点和有向边组成，目的是通过每次分类将整个特征空间进行划分，这样就可以得到不同的分类样本。
决策树算法中涉及到了特征的选择，决策树的生成和剪枝。不同的决策树学习算法生成过程是相同的。决策树的剪枝就是为了防止过拟合。

例如ID3算法是在各个节点上选择信息增益最大的特征进行分裂并构建决策树，当然这样的问题是会选择取值较多的特征。

例如CART可以用来分类和回归。当它用作回归树时，则利用平方误差最小化作为选择特征的准则，当它用作分类树时，则利用基尼指数最小化原则选择特征。

随机森林
　随机森林也是基于决策树的算法，只不过是利用集成的思想来提升单颗决策树的分类性能。主要特点是由于随机选择样本和特征，所以不容易陷入过拟合。

随机森林算法的主要步骤是：
从样本集中用Bootstrap随机选取n个样本，并从所有属性中随机选取K个属性，选择最佳分割属性作为节点建立分类器（CART，SVM等）
重复以上m次，即建立了m个分类器，并通过投票表决结果，决定数据属于哪一类。
GBDT
　　梯度提升决策树GBDT也是一种基于集成思想的决策树模型。

算法简述是每次迭代生成一颗新的决策树，计算损失函数在每个训练样本点的一阶导数gi和二阶导数hi ，然后通过

最低0.47元/天解锁文章

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

一摩尔自由 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。