为什么选择的激活函数普遍具有梯度消失的特点?

高速上的蜗牛

于 2020-02-14 21:53:42 发布

阅读量142

点赞数

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_45518139/article/details/104320468

版权

为什么选择的激活函数普遍具有梯度消失的特点?
后来看到一篇文章的描述才发现，正是因为模拟人脑的生物神经网络的方法。在2001年有研究表明生物脑的神经元工作具有稀疏性，这样可以节约尽可能多的能量，据研究，只有大约1%-4%的神经元被激活参与，绝大多数情况下，神经元是处于抑制状态的，因此ReLu函数反而是更加优秀的近似生物激活函数。所以抑制现象是必须发生的，这样能更好的拟合特征。同时由于激活函数的导数是小于1的，所以在梯度向后传导时，梯度衰减会非常大，迅速接近零，这就是梯度消失问题。

高速上的蜗牛

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
为什么选择的激活函数普遍具有梯度消失的特点?

为什么选择的激活函数普遍具有梯度消失的特点?后来看到一篇文章的描述才发现，正是因为模拟人脑的生物神经网络的方法。在2001年有研究表明生物脑的神经元工作具有稀疏性，这样可以节约尽可能多的能量，据研究，只有大约1%-4%的神经元被激活参与，绝大多数情况下，神经元是处于抑制状态的，因此ReLu函数反而是更加优秀的近似生物激活函数。所以抑制现象是必须发生的，这样能更好的拟合特征。同时由于激活函数的导数...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。