《动手学深度学习》学习pytorch之softmax实现、FashionMNIST数据集训练

最新推荐文章于 2023-10-13 15:01:57 发布

Nick_Spider

最新推荐文章于 2023-10-13 15:01:57 发布

阅读量1.2k

点赞数 1

分类专栏： pytorch 机器学习 python 文章标签： pytorch softmax python fashionMNIST 机器学习

本文链接：https://blog.csdn.net/weixin_39198406/article/details/104318940

版权

本文深入探讨softmax运算及其在处理分类问题中的应用，包括从零实现softmax、理解交叉熵损失函数以及在FashionMNIST数据集上的训练和评估。通过构建简单的线性回归模型，展示了如何在PyTorch中使用softmax进行预测。

摘要由CSDN通过智能技术生成

本文介绍以下几点：

softmax从零实现
softmax的简洁实现

softmax从零实现

导入包

# import needed package
%matplotlib inline
from IPython import display
import matplotlib.pyplot as plt

import torch
import torchvision
import torchvision.transforms as transforms
import time

import sys
sys.path.append("/home/kesci/input")
import d2lzh1981 as d2l

print(torch.__version__)
print(torchvision.__version__)

基本概念

对于分类问题，真实标签通常是离散值，我们通过模型和权重输出的值称之为置信度，置信度和特征值有关，且同一条数据对于不同类别的预测输出可能差距会很大，导致我们难以直观判断这些值的意义，且真实标签与其不确定范围的输出（置信度）之间的误差确难以衡量。
softmax运算符（softmax operator）解决了以上两个问题。它通过下式将输出值变换成值为正且和为1的概率分布：

$\hat{y}_j = \frac{ \exp(o_j)}{\sum_{i=1}^3 \exp(o_i)}$

代码如下

def softmax(X):
    """
    softmax 公式
    X 特征值
    """
    X_exp = X.exp()
    partition = X_exp.sum(dim=1, keepdim=True)
    return X_exp / partition  # 这里应用了广播机制
   
print(softmax(torch.tensor([[10.0, 10.1, 10.2]])))