瞎聊机器学习——集成学习

什么是集成学习?

对于一个机器学习问题,通常我们有两种策略,一种是研发人员尝试各种模型,选择其中表现最好的模型进行调参优化;另一种策略就是将多个分类器的结果统一成一个最终的决策,这种策略我们就称之为集成学习,其中每个单独的分类器称为基分类器。

集成学习的种类

  • Boosting

Boosting的基本思路是将基分类器层层叠加,每一层在训练的时候,对前一层基分类器分错的样本,给予更高的权重。在测试的时候根据各层分类器的结果的加权得到最终结果。

Boosting方法训练基分类器时采用串行的方式,使得各个基分类器之间有依赖。

  • Bagging

与Boosting的串行训练方式不同,Bagging在训练的过程中,各基分类器之间无强依赖,可以进行并行训练,最著名的Bagging算法是基于决策树基分类器组成的随机森林。

Bagging中为了让基分类器之间相互独立,会将训练集分成若干个子集,在做最终决策的时候,每个个体单独做出判断,再通过投票的方式做出最终的集体决策。

常见的基分类器-决策树

最常用的基分类器时决策树,主要原因如下:

(1)决策树可以较为方便地将样本的权重整合到训练过程中,而不需要使用过采样的方法来调整样本权重。

(2)决策树的表达能力和泛化能力,可以通过调节树的层数来进行调节。

(3)决策树的不稳定性更适合用于基分类器。

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

二哥不像程序员

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值