多层感知机的简洁实现【动手学深度学习】

最新推荐文章于 2024-01-17 17:05:03 发布

九羽-

最新推荐文章于 2024-01-17 17:05:03 发布

阅读量148

点赞数

分类专栏：深度学习文章标签：深度学习人工智能

原文链接：https://zh.d2l.ai/

版权

深度学习专栏收录该内容

6 篇文章 0 订阅

订阅专栏

整理自：《动手学深度学习》

在softmax的基础上加入了一个隐藏层，使得函数更加复杂，能够拟合一些非线性的数据。

隐藏层后紧跟着一层激活函数，是为了防止多层模型退化为线性模型。

此章的数据集获取、训练函数继承自上一章：softmax回归的简洁实现【动手学深度学习】_九羽-的博客-CSDN博客

1. 获取数据集

import torch
from torch import nn
from d2l import torch as d2l

batch_size = 256
train_iter, test_iter = d2l.load_data_fashion_mnist(batch_size)

2. 定义模型

net = nn.Sequential(
    nn.Flatten(),
    nn.Linear(784, 256), nn.ReLU(),
    nn.Linear(256,10)
)
def init_weight(m):
    if type(m)==nn.Linear:
        nn.init.normal_(m.weight, std=0.01)
net.apply(init_weight)

3. 损失函数，优化算法

loss = nn.CrossEntropyLoss(reduction='none')
trainer = torch.optim.SGD(net.parameters(), lr=0.1)

4. 训练

num_epochs = 10
d2l.train_ch3(net, train_iter, test_iter, loss, num_epochs, trainer)

九羽-

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
多层感知机的简洁实现【动手学深度学习】

整理自：《动手学深度学习》在softmax的基础上加入了一个隐藏层，使得函数更加复杂，能够拟合一些非线性的数据。隐藏层后紧跟着一层激活函数，是为了防止多层模型退化为线性模型。此章的数据集获取、训练函数继承自上一章：softmax回归的简洁实现【动手学深度学习】_九羽-的博客-CSDN博客1. 获取数据集import torchfrom torch import nnfrom d2l import torch as d2lbatch_size = 256train_iter.
复制链接

扫一扫

专栏目录