GBDT实战

最新推荐文章于 2022-09-30 11:40:56 发布

听挽风讲大数据

最新推荐文章于 2022-09-30 11:40:56 发布

阅读量810

点赞数

分类专栏： Machine Learning 文章标签： GBDT实战 GradientBoostingClassifier函数 GradientBoostingRegressor函数

本文链接：https://blog.csdn.net/huahuaxiaoshao/article/details/86484357

版权

1.GBDT函数的参数
      （1）n_estimators: 也就是弱学习器的最大迭代次数，或者说最大的弱学习器的个数。一般来说n_estimators太小，容易欠拟合，n_estimators太大，又容易过拟合，一般选择一个适中的数值。默认是100。在实际调参的过程中，我们常常将n_estimators和下面介绍的参数learning_rate一起考虑。
      （2）learning_rate: 即每个弱学习器的权重缩减系数ν，也称作步长，在原理篇的正则化章节我们也讲到了，加上了正则化项，我们的强学习器的迭代公式为fk(x)=fk−1(x)+νhk(x)。ν的取值范围为0<ν≤1。对于同样的训练集拟合效果，较小的ν意味着我们需要更多的弱学习器的迭代次数。通常我们用步长和迭代最大次数一起来决定算法的拟合效果。所以这两个参数n_estimators和learning_rate要一起调参。一般来说，可以从一个小一点的ν开始调参，默认是1。
      （3）subsample: 即我们在原理篇的正则化章节讲到的子采样，取值为(0,1]。注意这里的子采样和随机森林不一样，随机森林使用的是放回抽样，而这里是不放回抽样。如果取值为1，则全部样本都使用，等于没有使用子采样。如果取值小于1，则只有一部分样本会去做GBDT的决策树拟合。选择小于1的比例可以减少方差，即防止过拟合，但是会增加样本拟合的偏差，因此取值不能太低。推荐在[0.5, 0.8]之间，默认是1.0，即不使用子采样。
      （4）i

最低0.47元/天解锁文章

听挽风讲大数据

关注

0
点赞
踩
2

收藏

觉得还不错? 一键收藏
0
评论
GBDT实战

1.GBDT函数的参数&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;（1）n_estimators: 也就是弱学习器的最大迭代次数，或者说最大的弱学习器的个数。一般来说n_estimators太小，容易欠拟合，n_estimators太大，又容易过拟合，一般选择一个适中的数值。默认是100。在实际调参的过程中，我们常常将n_estimators和下面介绍的参数learn...
复制链接

扫一扫