2020-09-28

集成学习方式:

1.bagging并行-(RF随机森林)

1)从原始样本中抽一部分样本作为训练集。每轮从原始样本中使用Boostraping有放回抽取n个样本,共进行k轮抽取,得到k个训练集。

2)每次使用一个训练集得到一个模型,共得到k个模型。将k个模型采用投票方式得到分类结果;对回归问题,计算上述模型的均值作为回归结果。

每次大约有三分之一的数据不被抽到,作为测试集。

基模型-同质/强分类器。

多个模型的平均来避免过拟合。

bagging:样本随机

随机森林:样本随机、特征随机

RF优点:大样本速度优势、泛化能力强、对部分特征缺失不敏感

RF缺点:对噪音较大易过拟合,但可用有些方法降噪、可解释性较决策树弱

2.boosting串行-(GBDT/Adaboost/XGBOOST)

3.stacking框架:结合上两种

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值