《机器学习by周志华》学习笔记-模型评估与选择-04

vanilla698

已于 2024-04-01 14:03:40 修改

阅读量422

点赞数 3

分类专栏：机器学习机器学习by周志华文章标签：机器学习学习笔记

于 2024-04-01 13:24:34 首次发布

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/vanilla698/article/details/136917307

版权

本文详细探讨了机器学习中偏差与方差的概念、作用和它们之间的关系。偏差衡量学习器的拟合能力，方差则反映了数据扰动对模型性能的影响。通过偏差-方差分解，可以理解学习器泛化性能的局限。此外，文章还讨论了偏差-方差窘境，以及如何通过控制训练程度来平衡两者。

摘要由CSDN通过智能技术生成

1、偏差与方差

1.1、概念

「偏差-方差分解（bias-variance decomposition）」是解释学习器泛化性能的一种重要工具。

「偏差」学习器期望预测与真实结果的偏离程度。

「方差」同样大小训练集的变动会导致学习器性能变化的度量。

「噪声」表达了在当前任务下，学习器所能达到的期望泛化误差的下界。

1.2、作用

「偏差-方差分解图」：可以对学习器的预期错误率进行拆解，以便我们更好的理解「为什么具有这样的性能？」的问题。

「偏差」：可以衡量学习器的拟合能力。拟合能力越强，偏差越小；拟合能力越弱，偏差越大。

「方差」：可以衡量数据扰动造成的影响。数据影响越大，方差越大；数据影响越小，方差越小。

「噪声」：可以衡量学习器所学问题的难度。难度越大，噪声越大；难度越小，噪声越小。给定学习器，为了能够取得更好的泛化性能，则需要使「偏差」较小，即充分拟合数据；并且使「方差」较小，即使数据影响小。

1.3、推导内容

从上文我们可以知道，算法在不同的训练集上学习的结果很可能是不同的，即便同一个分布，也可能出现不同的输出结果。

3学习器x，对于测试样本D，y为x的真实标记。f(x,D)为x在测试样本D上的预测输出。学习器的期望预测为：

$\bar{f}(x)=E_{D}[f(x;D)]$

最低0.47元/天解锁文章

关注

3
点赞
踩
4

收藏

觉得还不错? 一键收藏
打赏
0
评论
《机器学习by周志华》学习笔记-模型评估与选择-04

偏差-方差分解（bias-variance decomposition）」是解释学习器泛化性能的一种重要工具。「偏差」学习器期望预测与真实结果的偏离程度。「方差」同样大小训练集的变动会导致学习器性能变化的度量。「噪声」表达了在当前任务下，学习器所能达到的期望泛化误差的下界。
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

vanilla698 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。