Softmax函数原理及Python实现

Softmax函数在机器学习和深度学习中用于将向量转化为概率分布。它通过对向量元素进行指数变换和归一化来实现。文章介绍了Softmax的原理,其性质(如输入加常数不变性),以及如何避免数据溢出问题的Python实现方法。
摘要由CSDN通过智能技术生成

Softmax原理


Softmax函数用于将分类结果归一化,形成一个概率分布。作用类似于二分类中的Sigmoid函数。

对于一个k维向量z,我们想把这个结果转换为一个k个类别的概率分布p(z)。softmax可以用于实现上述结果,具体计算公式为:
s o f t m a x ( x i ) = e x p ( x i ) ∑ j e x p ( x j ) softmax(x_i) = \frac{exp(x_i)}{\sum_j exp(x_j)} softmax(xi)=jexp(xj)exp(xi)
对于k维向量z来说,其中 z i ∈ R z_i \in R ziR,我们使用指数函数变换可以将元素的取值范围变换到 ( 0 , + ∞ ) (0, +\infin) (0,+),之后我们再所有元素求和将结果缩放到[0,1],形成概率分布。

常见的其他归一化方法,如max-min、z-score方法并不能保证各个元素为正,且和为1。

Softmax性质


输入向量x加上一个常数c后求softmax结算结果不变,即:
s o f t m a x ( x ) = s o f t m a x ( x + c ) softmax(x) = softmax(x&#

评论 3
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值