《机器学习by周志华》学习笔记-模型评估与选择-04

本文详细探讨了机器学习中偏差与方差的概念、作用和它们之间的关系。偏差衡量学习器的拟合能力,方差则反映了数据扰动对模型性能的影响。通过偏差-方差分解,可以理解学习器泛化性能的局限。此外,文章还讨论了偏差-方差窘境,以及如何通过控制训练程度来平衡两者。
摘要由CSDN通过智能技术生成

1、偏差与方差

1.1、概念

「偏差-方差分解(bias-variance decomposition)」是解释学习器泛化性能的一种重要工具。

「偏差」学习器期望预测与真实结果的偏离程度。

「方差」同样大小训练集的变动会导致学习器性能变化的度量。

「噪声」表达了在当前任务下,学习器所能达到的期望泛化误差的下界。

1.2、作用

「偏差-方差分解图」:可以对学习器的预期错误率进行拆解,以便我们更好的理解「为什么具有这样的性能?」的问题。

「偏差」:可以衡量学习器的拟合能力。拟合能力越强,偏差越小;拟合能力越弱,偏差越大。

「方差」:可以衡量数据扰动造成的影响。数据影响越大,方差越大;数据影响越小,方差越小。

「噪声」:可以衡量学习器所学问题的难度。难度越大,噪声越大;难度越小,噪声越小。给定学习器,为了能够取得更好的泛化性能,则需要使「偏差」较小,即充分拟合数据;并且使「方差」较小,即使数据影响小。

1.3、推导内容

从上文我们可以知道,算法在不同的训练集上学习的结果很可能是不同的,即便同一个分布,也可能出现不同的输出结果。

3学习器x,对于测试样本D,y为x的真实标记。f(x,D)为x在测试样本D上的预测输出。学习器的期望预测为:

\bar{f}(x)=E_{D}[f(x;D)]

  • 3
    点赞
  • 4
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

vanilla698

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值