2020-09-28

最新推荐文章于 2021-09-05 16:33:59 发布

除是卢龙山海险

最新推荐文章于 2021-09-05 16:33:59 发布

阅读量74

点赞数

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_41144461/article/details/108858060

版权

集成学习方式：

1.bagging并行-（RF随机森林）

1）从原始样本中抽一部分样本作为训练集。每轮从原始样本中使用Boostraping有放回抽取n个样本，共进行k轮抽取，得到k个训练集。

2）每次使用一个训练集得到一个模型，共得到k个模型。将k个模型采用投票方式得到分类结果；对回归问题，计算上述模型的均值作为回归结果。

每次大约有三分之一的数据不被抽到，作为测试集。

基模型-同质/强分类器。

多个模型的平均来避免过拟合。

bagging：样本随机

随机森林：样本随机、特征随机

RF优点：大样本速度优势、泛化能力强、对部分特征缺失不敏感

RF缺点：对噪音较大易过拟合，但可用有些方法降噪、可解释性较决策树弱

2.boosting串行-（GBDT/Adaboost/XGBOOST）

3.stacking框架：结合上两种

除是卢龙山海险

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
2020-09-28

集成学习方式：1.bagging并行-（RF随机森林）1）从原始样本中抽一部分样本作为训练集。每轮从原始样本中使用Boostraping有放回抽取n个样本，共进行k轮抽取，得到k个训练集。2）每次使用一个训练集得到一个模型，共得到k个模型。将k个模型采用投票方式得到分类结果；对回归问题，计算上述模型的均值作为回归结果。每次大约有三分之一的数据不被抽到，作为测试集。基模型-同质/强分类器。多个模型的平均来避免过拟合。bagging：样本随机随机森林：样本随机、特征随机RF优
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。