深度学习——早停法（Early Stopping）

最新推荐文章于 2025-02-28 08:10:21 发布

左小田^O^

最新推荐文章于 2025-02-28 08:10:21 发布

阅读量7.6k

点赞数 5

分类专栏：深度学习 pytorch

本文链接：https://blog.csdn.net/qq_45802081/article/details/115454431

版权

深度学习同时被 2 个专栏收录

34 篇文章

订阅专栏

pytorch

26 篇文章

订阅专栏

早停法是一种用于神经网络训练的正则化技术，旨在平衡欠拟合和过拟合。通过在训练过程中监控验证集的性能，当连续多个epoch验证集精度不再提升时，提前终止训练，从而选取最优模型。这种方法减少了手动调整epoch数的需要，并有助于防止过大的权重导致的过拟合问题。实践中，通常在连续多个epoch未达到最佳验证集精度时停止训练，以确保模型的泛化能力。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

学习链接：https://www.jianshu.com/p/9ab695d91459
https://www.datalearner.com/blog/1051537860479157

目的：

为了获得性能良好的神经网络，网络定型过程中需要进行许多关于所用设置（超参数）的决策。
超参数之一是定型周期（epoch）的数量：亦即应当完整遍历数据集多少次（一次为一个epoch）？如果epoch数量太少，网络有可能发生欠拟合（即对于定型数据的学习不够充分）；如果epoch数量太多，则有可能发生过拟合（即网络对定型数据中的“噪声”而非信号拟合）。

早停法旨在解决epoch数量需要手动设置的问题。它也可以被视为一种能够避免网络发生过拟合的正则化方法（与L1/L2权重衰减和丢弃法类似）。

根本原因就是因为继续训练会导致测试集上的准确率下降。
那继续训练导致测试准确率下降的原因猜测可能是1. 过拟合 2. 学习率过大导致不收敛

原理

1.将数据分为训练集和验证集
2.每个epoch结束后（或每N个epoch后）：在验证集上获取测试结果，随着epoch的增加，如果在验证集上发现测试误差上升，则停止训练；
3.将停止之后的权重作为网络的最终参数。

这种做法很符合直观感受，因为精度都不再提高了，在继续训练也是无益的，只会提高训练的时间。
那么该做法的一个重点便是怎样才认为验证集精度不再提高了呢？并不是说验证集精度一降下来便认为不再提高了，因为可能经过这个Epoch后，精度降低了，但是随后的Epoch又让精度又上去了，所以不能根据一两次的连续降低就判断不再提高。
一般的做法是，在训练的过程中，记录到目前为止最好的验证集精度，当连续10次Epoch（或者更多次）没达到最佳精度时，则可以认为精度不再提高了。
直观感受：
在这里插入图片描述
最优模型是在垂直虚线的时间点保存下来的模型，即处理测试集时准确率最高的模型。

为什么能够减小拟合：
当还未在神经网络运行太多迭代过程的时候，w参数接近于0，因为随机初始化w值的时候，它的值是较小的随机值。当你开始迭代过程，w的值会变得越来越大。到后面时，w的值已经变得十分大了。所以early stopping要做的就是在中间点停止迭代过程。我们将会得到一个中等大小的w参数，会得到与L2正则化相似的结果，选择了w参数较小的神经网络。

Early Stopping的缺点：
没有采取不同的方式来解决优化损失函数和降低方差这两个问题，而是用一种方法同时解决两个问题，结果就是要考虑的东西变得更复杂。之所以不能独立地处理，因为如果你停止了优化代价函数，你可能会发现代价函数的值不够小，同时你又不希望过拟合

作者：zzkdev
链接：https://www.jianshu.com/p/9ab695d91459
来源：简书
著作权归作者所有。商业转载请联系作者获得授权，非商业转载请注明出处。