神经网络中的名词解释：梯度下降、Epoch、Batch_size、迭代

最新推荐文章于 2024-03-19 17:56:49 发布

图灵生信

最新推荐文章于 2024-03-19 17:56:49 发布

阅读量5.9k

点赞数 10

分类专栏：深度学习

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/liangbilin/article/details/108903754

版权

深度学习专栏收录该内容

25 篇文章 2 订阅

订阅专栏

（一）梯度下降

梯度下降是在机器学习中用于寻找最佳结果（即曲线最小值）的一种迭代优化算法。

如下图所示，要使绿色点达到最小值，需要考虑两个问题：1）绿色点向左还是右移动；2）移动多大的距离。

对于向左还是向右移动的问题，我们可以根据数学求导公式来进行判断，即判断曲线还是在绿色点位置是递增还是递减，进而决定点该想哪个方向移动。

在这里插入图片描述

对于移动多大的距离问题，以下图中绿色和蓝色两个点为例。在两个点位置分别做一条切线，可以看到蓝色点的切线斜率是低于绿色点的。这提示，蓝色点很有可能更加接近最小值，那么此时蓝色点移动的距离就要更小一些。

在这里插入图片描述

这里只介绍了最最最简单粗暴的理解，建议深入阅读参考资料

（二） Batch_size

因为机器学习需要的数据量非常庞大，一次性将数据完全读入计算机内存是不现实的。为了解决这个问题，我们需要把数据分割成一小块，再一块一块地读入到内存中，并且在每一块数据计算完成后，更新神经网络参数的权重。这里所说的“小块”被称为“Batch”，而每一个Batch中的数据量，则成为Bathc_size。

（三） Epoch

上面介绍了，当数据量非常庞大时，需要将数据分割成多个Batch进行计算。而Epoch是指 “当一个完整的数据集通过了神经网络一次并且返回了一次，这个过程称为一个 epoch。”

简单理解Epoch就是所有的数据在神经网络中做了一次运算。

Epoch 参数设置多少合适？

实际情况下，构建的神经网络模型中，Epoch参数往往设置大于1。原因是：在神经网络中传递完整的数据集一次是不够的，而且我们需要将完整的数据集在同样的神经网络中传递多次。我们使用的是有限的数据集，并且我们使用一个迭代过程即梯度下降，优化学习过程和图示。因此仅仅更新权重一次或者说使用一个 epoch 是不够的。

随着 epoch 数量增加，神经网络中的权重的更新次数也增加，曲线从欠拟合变得过拟合。对于不同的数据集，epoch参数设置的值也不同。数据的多样性也会影响合适的 epoch 的数量。比如，只有黑色的猫的数据集，以及有各种颜色的猫的数据集。

在这里插入图片描述

（四）迭代（Iteration）

上面介绍了，当数据量非常庞大时，需要将数据分割成多个Batch进行计算。1个Batch通过计算过程就被称为1次迭代。

因此，对于一个神经网络训练过程而言，迭代次数等于Batch个数。

例如，对于一个有 2000 个训练样本的数据集。将 2000 个样本分成大小为 500 的 batch，那么完成一个 epoch 需要 4 个 iteration。

参考资料

https://medium.com/towards-data-science/epoch-vs-iterations-vs-batch-size-4dfb9c7ce9c9
神经网络训练中，傻傻分不清Epoch、Batch Size和迭代. 机器之心

关注

10
点赞
踩
44

收藏

觉得还不错? 一键收藏
0
评论
神经网络中的名词解释：梯度下降、Epoch、Batch_size、迭代

（一）梯度下降梯度下降是在机器学习中用于寻找最佳结果（即曲线最小值）的一种迭代优化算法。如下图所示，要使绿色点达到最小值，需要考虑两个问题：1）绿色点向左还是右移动；2）移动多大的距离。对于向左还是向右移动的问题，我们可以根据数学求导公式来进行判断，即判断曲线还是在绿色点位置是递增还是递减，进而决定点该想哪个方向移动。对于移动多大的距离问题，以下图中绿色和蓝色两个点为例。在两个点位置分别做一条切线，可以看到蓝色点的切线斜率是低于绿色点的。这提示，蓝色点很有可能更加接近最小值，那么此时蓝色点
复制链接

扫一扫

专栏目录

图灵生信 CSDN认证博客专家 CSDN认证企业博客

码龄6年

45: 原创

4万+: 周排名

193万+: 总排名

24万+: 访问

: 等级

927: 积分

519: 粉丝

137: 获赞

28: 评论

616: 收藏

私信

关注

热门文章

分类专栏

BioAI 2篇
flask 1篇
深度学习 25篇
计算机基础 20篇
Debug 1篇
生物信息 10篇

最新评论

解决flask （flask-restful）中文乱码问题
阿速之吉: 现在flask版本更新了，JSON_AS_ASCII属性弃用了，解决方案可看这篇文章 https://blog.csdn.net/u012452483/article/details/132859800
修改vcf文件中的染色体名
Xu_sunflower: 先确定NC编号对应的Chr分别是哪一个（NCBI上查某一具体基因时，显示该基因位于哪一染色体会有对应NC编号），然后使用sed命令或者awk命令进行替换，命令脚本都可以百度搜，根据自身情况多改改多尝试。
Python Pandas 根据一列或几列的值，对另一列赋值
Lyra Tan: 帮助很大，太感谢了！
修改vcf文件中的染色体名
m0_60891394: 运行不成功呀，生成了一个二进制文件
图神经网络（2）：基于DGL实现GCN算法
xiaoshenkecc: 请问大佬运行数据集那里的时候出现错误AttributeError: 'CoraGraphDataset' object has no attribute 'graph是应该如何解决呢？

您愿意向朋友推荐“博客详情页”吗？

强烈不推荐
不推荐
一般般
推荐
强烈推荐

提交

最新文章

目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。