机器学习算法-随机森林(RF)

本文介绍了随机森林的基本思想、算法步骤、优缺点以及实战应用。随机森林是一种集成学习方法,基于决策树构建,适用于分类和回归问题。通过Bootstrap抽样生成多个训练集,用随机特征构建决策树,最后通过多数投票或平均法得出结果。随机森林具有并行化训练优势,对特征缺失不敏感,但可能在某些情况过拟合。
摘要由CSDN通过智能技术生成

随着大数据和人工智能热潮的相继而来,促使机器学习近些年也火的一塌糊涂。机器学习方法已在生产、科研和生活中有着广泛应用,而集成学习则是机器学习的首要热门方向。集成学习是使用一系列学习器进行学习,并使用某种规则把各个学习结果进行整合从而获得比单个学习器更好的学习效果的一种机器学习方法。集成学习有两个分支,一个是Boosting派系,另一个是Bagging流派,二者的区别主要如下:

Boosting–假定原始样本集中有 n 个训练样本,且服从均匀分布。基于此先训练一个模型,接下来通过提高那些在前一轮被弱分类器分错样例的权值,减小前一轮分对样本的权值,误分的样本在后续将受到更多的关注。再不断基于新的分布训练新的弱分类器。最后再用加法模型将弱分类器进行线性组合,即增大错误率小的分类器的权值,同时减小错误率较大的分类器的权值。其代表算法为Adaboost。已在博客机器学习算法-Adaboost中介绍,感兴趣可以查阅。
Bagging–假定原始样本集中有 n 个训练样本,每轮从原始样本集中使用有放回重复抽样(Bootstraping)的方法抽取 m m<n )个训练样本,共进行 k 轮抽取,得到 k

  • 1
    点赞
  • 13
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值