二、Batch Normalization 批标准化

最新推荐文章于 2020-07-08 22:47:48 发布

嘻哈吼嘿呵

最新推荐文章于 2020-07-08 22:47:48 发布

阅读量131

点赞数

分类专栏： # 深度学习

原文链接：https://www.jianshu.com/p/3da70e672c8b

版权

深度学习专栏收录该内容

20 篇文章 2 订阅

订阅专栏

首先看一下什么是一般的 normalization：

在机器学习中，我们需要对输入的数据做预处理，
可以用 normalization 归一化，或者 standardization 标准化，
用来将数据的不同 feature 转换到同一范围内，
normalization 归一化：将数据转换到 [0, 1] 之间，
standardization 标准化：转换后的数据符合标准正态分布

为什么需要做归一化标准化等 feature scaling？

因为如果不做这样的处理，不同的特征具有不同数量级的数据，它们对线性组合后的结果的影响所占比重就很不相同，数量级大的特征显然影响更大。
进一步体现在损失函数上，影响也更大，可以看一下，feature scaling 之前，损失函数的切面图是椭圆的，之后就变成圆，无论优化算法在何处开始，都更容易收敛到最优解，避免了很多弯路。

在神经网络中，不仅仅在输入层要做 feature scaling，在隐藏层也需要做。

尤其是在神经网络中，特征经过线性组合后，还要经过激活函数，
如果某个特征数量级过大，在经过激活函数时，就会提前进入它的饱和区间，
即不管如何增大这个数值，它的激活函数值都在 1 附近，不会有太大变化，
这样激活函数就对这个特征不敏感。
在神经网络用 SGD 等算法进行优化时，不同量纲的数据会使网络失衡，很不稳定。

在神经网络中，这个问题不仅发生在输入层，也发生在隐藏层，
因为前一层的输出值，对后面一层来说，就是它的输入，而且也要经过激活函数，

所以就需要做 batch normalization

就是在前一层的线性输出 z 上做 normalization：需要求出这一 batch 数据的平均值和标准差，
然后再经过激活函数，进入到下一层。

嘻哈吼嘿呵

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
二、Batch Normalization 批标准化

首先看一下什么是一般的 normalization：在机器学习中，我们需要对输入的数据做预处理，可以用 normalization 归一化，或者 standardization 标准化，用来将数据的不同 feature 转换到同一范围内，normalization 归一化：将数据转换到 [0, 1] 之间，standardization 标准化：转换后的数据符合标准正态分布...
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。