机器学习算法-随机森林(RF)

最新推荐文章于 2024-06-26 06:30:00 发布

AI_BigData_WH

最新推荐文章于 2024-06-26 06:30:00 发布

阅读量5.9k

点赞数 1

分类专栏：机器学习文章标签：随机森林机器学习决策树分类算法回归算法

本文链接：https://blog.csdn.net/AI_BigData_wh/article/details/78151232

版权

本文介绍了随机森林的基本思想、算法步骤、优缺点以及实战应用。随机森林是一种集成学习方法，基于决策树构建，适用于分类和回归问题。通过Bootstrap抽样生成多个训练集，用随机特征构建决策树，最后通过多数投票或平均法得出结果。随机森林具有并行化训练优势，对特征缺失不敏感，但可能在某些情况过拟合。

摘要由CSDN通过智能技术生成

随着大数据和人工智能热潮的相继而来，促使机器学习近些年也火的一塌糊涂。机器学习方法已在生产、科研和生活中有着广泛应用，而集成学习则是机器学习的首要热门方向。集成学习是使用一系列学习器进行学习，并使用某种规则把各个学习结果进行整合从而获得比单个学习器更好的学习效果的一种机器学习方法。集成学习有两个分支，一个是Boosting派系，另一个是Bagging流派，二者的区别主要如下：

Boosting–假定原始样本集中有 $n$ 个训练样本，且服从均匀分布。基于此先训练一个模型，接下来通过提高那些在前一轮被弱分类器分错样例的权值，减小前一轮分对样本的权值，误分的样本在后续将受到更多的关注。再不断基于新的分布训练新的弱分类器。最后再用加法模型将弱分类器进行线性组合，即增大错误率小的分类器的权值，同时减小错误率较大的分类器的权值。其代表算法为Adaboost。已在博客机器学习算法-Adaboost中介绍，感兴趣可以查阅。
Bagging–假定原始样本集中有 $n$ 个训练样本，每轮从原始样本集中使用有放回重复抽样（Bootstraping）的方法抽取 $m$ （ $m<n$ ）个训练样本，共进行 $k$ 轮抽取，得到 k

最低0.47元/天解锁文章

AI_BigData_WH

关注

1
点赞
踩
13

收藏

觉得还不错? 一键收藏
0
评论
机器学习算法-随机森林(RF)

随着大数据和人工智能热潮的相继而来，促使机器学习近些年也火的一塌糊涂。机器学习方法已在生产、科研和生活中有着广泛应用，而集成学习则是机器学习的首要热门方向。集成学习是使用一系列学习器进行学习，并使用某种规则把各个学习结果进行整合从而获得比单个学习器更好的学习效果的一种机器学习方法。集成学习有两个分支，一个是Boosting派系，另一个是Bagging流派，二者的区别主要如下：Boosting–假定原
复制链接

扫一扫

专栏目录