随机森林算法梳理

随机森林算法梳理

1. 集成学习概念

集成学习是通过在数据上构建多个模型,通过一定的结合策略,集成所有模型的建模结果的方法。

2. 个体学习器概念

集成学习中,个体学习器是指单个的模型,常见的集成学习算法如随机森林中,个体学习器为CART决策树,其个体学习器为同一种类的。

目前来说,同质个体学习器的应用是最广泛的,一般我们常说的集成学习的方法都是指的同质个体学习器。而同质个体学习器使用最多的模型是CART决策树和神经网络。同质个体学习器按照个体学习器之间是否存在依赖关系可以分为两类,第一个是个体学习器之间存在强依赖关系,一系列个体学习器基本都需要串行生成,代表算法是boosting系列算法,第二个是个体学习器之间不存在强依赖关系,一系列个体学习器可以并行生成,代表算法是bagging和随机森林(Random Forest)系列算法。下面就分别对这两类算法做一个概括总结。

3. boosting 和 bagging

在集成学习中,按照个体学习器之间是否存在依赖关系可以分为两类;第一类是个体学习器之间存在强依赖关系,一系列个体学习器基本都需要串行生产,代表算法是boosting系列算法;一类是个体学习器之间不存在强依赖关系,一系列个体学习器可以并行生成,代表算法是bagging算法。

boosting算法的工作机制是首先从训练集中用初始权重训练出一个弱学习器,根据弱学习器的误差率表现来更新新训练样本的权重,使得之前弱学习器误差率高的训练样本点的权重变高,这样误差率高的样本点在后面的学习器中会得到更多的

  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值