CS231N-权重初始化

零初始化(Zero Initialization):将所有的权重和偏置初始化为零

零初始化可能会导致对称问题,所有参数不仅初始化的值是一样的,而且训练过程中的变化也是一样的,一层中的神经元状态会始终保持一致,没有办法学习和表达更复杂的特征。

随机初始化(Random Initialization):将权重和偏置随机地初始化为均值为0,方差为1的正态分布的随机值

  • 因为参数都是独立同分布的采样,那么线性输出y的方差就会叠加。这意味着输入经过神经元后,输出的离散程度被提高了

  • 当我们不使用任何激活函数的时候,放大的y值就会被累积在反向传播的过程里,这样就会造成梯度爆炸

  • 如果使用双曲正切函数作为激活函数,那么又可能因为y的值过大或过小而得到一个非常小的梯度,这样反而会造成梯度消失的问题

Xavier初始化(Xavier Initialization):也称为Glorot初始化,它是一种针对全连接层的参数初始化方法

为了让输出y的方差落在一个可控的范围内,例如让他等于1,这样求出参数w分布的方差就等于1/n,假设有n个输入。如果我们不仅考虑输入的维度,也考虑下一层神经元的数量,那么平均后的方差就等于

2 / ( Nin+Nout ) ,即2除以输入和输出神经元的总和

  • 11
    点赞
  • 6
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值