简单谈谈Cross Entropy Loss

最新推荐文章于 2024-06-09 10:13:12 发布

时光杂货店

最新推荐文章于 2024-06-09 10:13:12 发布

阅读量10w+

点赞数 210

分类专栏：机器学习文章标签： cross entropy loss tensorflow 代码实现原理 softmax

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/xg123321123/article/details/80781611

版权

写在前面

分类问题和回归问题是监督学习的两大种类：分类问题的目标变量是离散的；回归问题的目标变量是连续的数值。
神经网络模型的效果及优化的目标是通过损失函数来定义的。

回归问题解决的是对具体数值的预测。比如房价预测、销量预测等都是回归问题。这些问题需要预测的不是一个事先定义好的类别，而是一个任意实数。解决回顾问题的神经网络一般只有一个输出节点，这个节点的输出值就是预测值。对于回归问题，常用的损失函数是均方误差( MSE，mean squared error )。

分类问题常用的损失函数为交叉熵( Cross Entropy Loss)。

这篇博客我们简单谈谈交叉熵损失函数。

交叉熵描述了两个概率分布之间的距离，当交叉熵越小说明二者之间越接近。[关于交叉熵的原理，我这有一篇简单明白的博客]

尽管交叉熵刻画的是两个概率分布之间的距离，但是神经网络的输出却不一定是一个概率分布。为此我们常常用Softmax回归将神经网络前向传播得到的结果变成概率分布。

softmax常用于多分类过程中，它将多个神经元的输出，归一化到( 0, 1) 区间内，因此Softmax的输出可以看成概率，从而来进行多分类。

假设我们有一个包含k个元素的数组V， $i$ 表示V中的第 $i$ 个元素，那么这 $i$ 个元素的softmax输出就是:

S_{i} = \frac{e^{i}}{\sum_{j = 1}^{k} e^{j}}

$S_i = \frac{e^i}{\sum_{j=1}^k e^j}$

为了举一个具体例子，特意盗了一张图，如下：[关于Softmax更简单明白的原理阐述，特意负责任地推荐我这篇博客]

这里写图片描述

注：在TensorFlow中使用Cross Entropy Loss时，主要是使用tf.nn.softmax_cross_entropy_with_logits这类函数，但这类函数需要输入的是未经过Softmax的Logits。而所谓的unscaled logits就可以粗略理解为没有经过Softmax的变量。这一点要与数学上的logits ( 一个事件发生与该事件不发生的比值的对数) 进行区分。

进入主题

简单复习了Softmax，开始进入主题：损失函数为什么要用Cross Entropy Loss。

出于直觉，人们会觉得可以使用classification error来做损失函数：

c l a s s i f i c a t i o n - e r r

最低0.47元/天解锁文章

时光杂货店

关注

210
点赞
踩
716

收藏

觉得还不错? 一键收藏
25
评论
简单谈谈Cross Entropy Loss

写在前面分类问题和回归问题是监督学习的两大种类。神经网络模型的效果及优化的目标是通过损失函数来定义的。回归问题解决的是对具体数值的预测。比如房价预测、销量预测等都是回归问题。这些问题需要预测的不是一个事先定义好的类别，而是一个任意实数。解决回顾问题的神经网络一般只有一个输出节点，这个节点的输出值就是预测值。对于回归问题，常用的损失函数是均方误差( MSE，mean squared ...
复制链接

扫一扫

专栏目录

时光杂货店 CSDN认证博客专家 CSDN认证企业博客

码龄12年

57: 原创

17万+: 周排名

201万+: 总排名

64万+: 访问

: 等级

4344: 积分

309: 粉丝

582: 获赞

99: 评论

1953: 收藏

私信

关注

热门文章

分类专栏

最新评论

论文阅读 - 《Neural Relation Extraction with Selective Attention over Instances》
weixin_42480968: 前N个样例的准确率，之前的提出At-least-one假设的那篇文章中就是使用的这个方法，包括前100，200，500个的准确率
深度增强学习（DRL）简单梳理
sweetliulang: 真的很好，感谢
简单谈谈Cross Entropy Loss
titer1: 经典结论最后的结论分类问题用 One Hot Label + Cross Entropy Loss Training 过程，分类问题用 Cross Entropy Loss，回归问题用 Mean Squared Error。 validation / testing 过程，使用 Classification Error更直观，也正是我们最为关注的指标。
深度增强学习（DRL）简单梳理
石头缝里的半株草: 感谢，解答了我很多疑惑，非常有收获。
生成对抗网络(GAN)简单梳理
Noora秋秋读书人: 大神！想知道生成了手写数字后该如何将这些图片进行有序排列呢？

最新文章

目录

评论 25

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。