机器学习中的数学——激活函数(六):Parametric ReLU(PReLU)函数

分类目录:《机器学习中的数学》总目录
相关文章:
· 激活函数:基础知识
· 激活函数(一):Sigmoid函数
· 激活函数(二):双曲正切函数(Tanh函数)
· 激活函数(三): 线性整流函数(ReLU函数)
· 激活函数(四):Leaky ReLU函数
· 激活函数(五):ELU函数
· 激活函数(六):Parametric ReLU(PReLU)函数
· 激活函数(七):Softmax函数
· 激活函数(八):Swish函数
· 激活函数(九):Maxout函数
· 激活函数(十):Softplus函数
· 激活函数(十一):Softsign函数
· 激活函数(十二):高斯误差线性单元(GELUs)


PReLU 也是 ReLU 的改进版本:
P R e L U ( x ) = { x , x > 0 α i x , x ≤ 0 PReLU(x)=\left\{ \begin{aligned} x & \quad ,x > 0 \\ \alpha_i x & \quad , x\leq 0\\ \end{aligned} \right. PReLU(x)={xαix,x>0,x0

PReLU函数中,参数 α \alpha α通常为0到1之间的数字,并且通常相对较小。

  • 如果 α i = 0 \alpha_i=0 αi=0,则PReLU(x)变为 ReLU。
  • 如果 α i > 0 \alpha_i>0 αi>0,则PReLU(x)变为Leaky ReLU。
  • 如果 α i \alpha_i αi是可学习的参数,则PReLU(x)为PReLU函数。

PReLU函数的特点:

  • 在负值域,PReLU的斜率较小,这也可以避免Dead ReLU问题。
  • 与ELU相比,PReLU 在负值域是线性运算。尽管斜率很小,但不会趋于0。
  • 10
    点赞
  • 34
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
应用场景 1. ReLU激活函数 原理:ReLU激活函数是一种简单的非线性激活函数,它将所有负数输入映射到零,将所有正数输入保持不变。即: $$ f(x) = \max(0, x) $$ 优点: - 计算简单,速度快,不需要像sigmoid和tanh一样进行复杂的计算和指数运算; - 避免了梯度消失问题,能够有效地训练深度神经网络; - 只有两种输出情况,计算量小,容易实现并行计算。 缺点: - ReLU的输出不是心化的,会导致一些神经元永远不会被激活,这被称为“死亡ReLU”问题; - 当输入为负数时,梯度为0,这会导致神经元在训练过程永远不会被更新,称为“ReLU坍塌”问题; - ReLU对于输入的负数部分完全忽略,没有进行任何处理,这可能会导致激活函数无法充分利用输入的信息。 应用场景:ReLU适用于大多数深度学习任务,特别是在卷积神经网络的卷积层和池化层,因为图像和视频数据通常具有稀疏性,ReLU可以有效减少计算量并提高模型性能。 2. Leaky ReLU激活函数 原理:Leaky ReLU激活函数是对ReLU的改进,它在输入为负数时,不直接将其变为0,而是乘上一个小的正数$\alpha $,通常取0.01,即: $$ f(x) = \begin{cases} x & \text{if } x\geq 0 \\ \alpha x & \text{if } x<0 \end{cases} $$ 优点: - Leaky ReLU能够缓解ReLU的“死亡ReLU”问题,使得神经元在输入为负数时也能够被激活; - Leaky ReLU比ReLU更加鲁棒,即更能够处理异常数据和噪声数据。 缺点: - Leaky ReLU仍然存在“ReLU坍塌”问题; - Leaky ReLU的计算比ReLU要复杂一些。 应用场景:Leaky ReLU适用于大多数深度学习任务,特别是在卷积神经网络的卷积层和池化层,因为它能够有效减少计算量并提高模型性能。 3. Parametric ReLU激活函数 原理:Parametric ReLU激活函数是对Leaky ReLU的改进,它允许学习一个参数$\alpha$,使得该参数能够在训练过程自适应地调整,即: $$ f(x) = \begin{cases} x & \text{if } x\geq 0 \\ \alpha x & \text{if } x<0 \end{cases} $$ 其$\alpha$是一个可学习的参数。 优点: - Parametric ReLU能够在训练过程自适应地调整参数,从而更加灵活和适应不同的数据分布; - Parametric ReLU比Leaky ReLU更加强大,因为它可以学习一个适合当前数据的$\alpha$值。 缺点: - Parametric ReLU的计算量比Leaky ReLU更大; - Parametric ReLU的参数量比Leaky ReLU更多。 应用场景:Parametric ReLU适用于各种深度学习任务,特别是在需要自适应地调整参数的任务,如图像分类、目标检测和语音识别等。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

von Neumann

您的赞赏是我创作最大的动力~

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值