深度学习基础（十二）—— ReLU vs PReLU

最新推荐文章于 2025-03-22 20:25:31 发布

五道口纳什

最新推荐文章于 2025-03-22 20:25:31 发布

阅读量2.5w

点赞数 2

分类专栏：深度学习

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/lanchunhui/article/details/52644823

版权

深度学习专栏收录该内容

61 篇文章

订阅专栏

从算法的命名上来说，PReLU 是对 ReLU 的进一步限制，事实上 PReLU（Parametric Rectified Linear Unit），也即 PReLU 是增加了参数修正的 ReLU。

在功能范畴上，ReLU 、 PReLU 和 sigmoid 、 tanh 函数一样都是作为神经元的激励函数（activation function）。

1. ReLU 与 PReLU

注意图中通道的概念，不通的通道对应不同的 $$

如果 $a_i=0$ ，那么 PReLU 退化为 ReLU；如果 $a_i$ 是一个很小的固定值（如ai=0.01），则 PReLU 退化为 Leaky ReLU（LReLU）。有实验证明，与 ReLU 相比，LReLU 对最终的结果几乎没什么影响。

2. 说明

PReLU 只增加了极少量的参数，也就意味着网络的计算量以及过拟合的危险性都只增加了一点点。特别的，当不同 channels 使用相同的 $a_i$ 时，参数就更少了。
BP 更新 $a_i$ 时，采用的是带动量的更新方式，如下图：

$Δ a i : = μ Δ a i + ϵ \partial ε \partial a i$ $\Delta a_i:=\mu \Delta a_i+\epsilon \frac{\partial \varepsilon}{\partial a_i}$

上式的两个系数分别是动量和学习率。

需要特别注意的是：更新 $a_i$ 时不施加权重衰减（L2正则化），因为这会把 $a_i$ 很大程度上 push 到 0。事实上，即使不加正则化，试验中 $a_i$ 也很少有超过1的。
整个论文， $a_i$ 被初始化为 0.25。

3. references

《Delving Deep into Rectifiers:Surpassing Human-Level Performance on ImageNet Classification》

深度学习——PReLU激活

五道口纳什

博客等级

码龄14年

3595
原创

3968
点赞

9533
收藏

7435
粉丝

关注

私信

热门文章

分类专栏

展开全部收起

最新评论

[Math Processing Error] 问题的解决（F5刷新页面与 Ctrl/Shift + F5 刷新页面的区别）
qq_46380278: 有的能解决有的网站好像也没用
[Math Processing Error] 问题的解决（F5刷新页面与 Ctrl/Shift + F5 刷新页面的区别）
2301_81505543: 还有没有其他方法啊，ctrl+f5不刷新，ctrl+R刷新了，但没有，急死了
音频、视频等文件格式（.ts、.meta）及其认识
Shuuc: meta 文件并不能打开
补码：统一加减运算
做而论道_CS: 虽然，计算机使用的是：二进制数。但是，进行算术计算时，二进制数也是数，与十进制是雷同的。二进制数，也是数，它也是完全正常的数字。并非是什么乱七八糟的：原码反码补码。千万不要听信那些砖家胡讲！就说四位二进制数吧。四位数范围是：0000 ~ 1111。相当于十进制：0 ~ 15。出现进位，即：2^4 = 16。这些数中，既没有小数点，也没有符号位。它们，都是正整数！计算机砖家就给它们编造了一个名称：无符号数。其实，这就是【忽悠】！计算机中有个加法器，其运算规则是：逢二进一。找两个无符号数相加，列竖式如下：　　　0 1 0 1　= 5 　　＋1 1 1 1　= 15 －－－－－－－－－－－进 1、 0 1 0 0　= 16 + 4 = 20 这就是 “无符号数” 的加法：　　5 + 15 = 16 + 4 = 20。计算完全正确！－－－－－－－－－－－－－－－－－但是，如果你忽略了进位呢？（或者说：故意舍弃了进位。）这就少算了 16 ！那么就是：5 + 15－16 = 5－1 = 4。此时的＋15，就相当于－1 了！为什么是－1 ？因为你：舍弃了进位，少算了 16。所以有：＋15－16 = －1。加法的竖式，依然如下：　　　0 1 0 1　= 5 　　＋1 1 1 1　= 15 （=－1）－－－－－－－－－－－略掉、0 1 0 0　= 4 但是，此时，这可就是【减法运算】了。你看吧，本来是两个 “无符号数” 相加，丢了进位，就变成了 “有符号数” 相减！由此可知，所谓的 “有符号数、无符号数、符号位”，就是瞎掰！二进制数，也就是普通的数字！只是因为： “弄丢了进位”，才会出来 “负数” 和 “减法”。
matplotlib tricks（关闭坐标刻度、坐标轴不可见）
qq_37404964: set_xticklabels([])是可以的

大家在看

最新文章

目录

展开全部

收起

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

五道口纳什 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。