深度学习:什么是模型收敛？

最新推荐文章于 2024-07-31 21:04:26 发布

菜鸟的追梦旅行

最新推荐文章于 2024-07-31 21:04:26 发布

阅读量1.3w

点赞数 7

分类专栏：深度学习文章标签：深度学习人工智能机器学习

原文链接：https://www.cnblogs.com/cindycindy/p/13470925.html

版权

深度学习专栏收录该内容

15 篇文章 3 订阅

订阅专栏

`理解`

打个简单的比方,训练网络,就好比解方程,为了得到这个方程的极值点,训练的过程就好比是找准一个方向,不断的朝这个方向靠近,使得方程的值不断减小,最终达到极值点,而不收敛,就是,不论你怎么跑,方程的解都不减小.即达不到最后的极值点.在loss上就表现为稳定性的比较大.跟迭代不收敛或者系统不稳定差不多，上下波动不能趋近一个定值。

`可能原因`

网络不收敛直观体现是loss函数无法下降，本质上是网络或者训练方法有问题，包括bachsize尺寸，是否数据归一化，学习率设计，初始化权重等，这些都需要检查一下。

参考链接：https://www.cnblogs.com/cindycindy/p/13470925.html

菜鸟的追梦旅行

关注

7
点赞
踩
42

收藏

觉得还不错? 一键收藏
1
评论
深度学习:什么是模型收敛？

理解打个简单的比方,训练网络,就好比解方程,为了得到这个方程的极值点,训练的过程就好比是找准一个方向,不断的朝这个方向靠近,使得方程的值不断减小,最终达到极值点,而不收敛,就是,不论你怎么跑,方程的解都不减小.即达不到最后的极值点.在loss上就表现为稳定性的比较大.跟迭代不收敛或者系统不稳定差不多，上下波动不能趋近一个定值。可能原因网络不收敛直观体现是loss函数无法下降，本质上是网络或者训练方法有问题，包括bachsize尺寸，是否数据归一化，学习率设计，初始化权重等，这些都需要检查一下。参考链
复制链接

扫一扫

专栏目录

评论 1

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。