Mnist手写体识别

该博客介绍了使用PyTorch构建和训练一个四层全连接网络来识别Mnist数据集中的手写数字。通过设置批量大小、数据加载器、定义网络结构、损失函数和优化器,进行训练和测试过程。网络模型包括四个隐藏层,每个隐藏层后跟ReLU激活函数,并最终输出10个类别的概率。训练过程中,每10个批次更新一次模型参数,并在每个epoch结束后进行测试,以评估模型的准确性和平均损失。
摘要由CSDN通过智能技术生成

Mnist手写体识别

网络结构

在这里插入图片描述

  • 单通道28×28的图像
  • 采用四层全连接网络
  • 采用分类的交叉熵损失

代码

导入库

import torch
import torch.nn as  nn
import torch.nn.functional as F
import torch.optim as optim
from torchvision import datasets,transforms

MNIST数据集

#批量大小
batch_size = 64
#MNIST数据集
train_dataset = datasets.MNIST(root='./mnist_data',
                               train=True,
                               transform=transforms.ToTensor(),
                               download=True)
test_dataset = datasets.MNIST(root='./mnist_data/',
                               train=False,
                               transform=transforms.ToTensor())
#Data Loader(Input Pipeline)
train_loader = torch.utils.data.DataLoader(dataset=train_dataset,
                                            batch_size=batch_size,
                                            shuffle=True)
test_loader = torch.utils.data.DataLoader(dataset=test_dataset,
                                            batch_size=batch_size,
                                            shuffle=False)

网络模型

class Net(nn.Module):
    def __init__(self):
        super(Net,self).__init__()
        self.l1 = nn.Linear(784,520)
        self.l2 = nn.Linear(520,320)
        self.l3 = nn.Linear(320,240)
        self.l4 = nn.Linear(240,120)
        self.l5 = nn.Linear(120,10)
    def forward(self,x):
        x = x.view(-1,784)#Flatten the data (n,1,28,28)->(n,784)
        x = F.relu(self.l1(x))
        x = F.relu(self.l2(x))
        x = F.relu(self.l3(x))
        x = F.relu(self.l4(x))
        return self.l5(x)

model = Net()
model = nn.DataParallel(model).cuda()

criterion = nn.CrossEntropyLoss()
optimizer = optim.SGD(model.parameters(),lr=0.01,momentum=0.5)#所有参数都更新,学习率0.01,动量0.5

训练

def train(epoch):
    model.train()
    for batch_idx,(data,target) in enumerate(train_loader):
        data = data.cuda()
        target = target.cuda()
        optimizer.zero_grad()
        output = model(data)
        loss = criterion(output,target)
        loss.backward()
        optimizer.step()#参数更新
        if batch_idx % 10 == 0:
            print('Train Epoch: {} [{}/{} ({:.0f}%)]\tLoss: {:.6f}'.format(
                 epoch,batch_idx*len(data),len(train_loader.dataset),
                 100. *batch_idx / len(train_loader),loss.item()))

测试

def test():
    model.eval()
    test_loss = 0
    correct = 0
    for data , target in test_loader:
        data  = data.cuda()
        target = target.cuda()
        output = model(data)
        #计算批量损失
        test_loss += criterion(output,target).item()
        #得到最大值的索引
        pred = output.data.max(1,keepdim=True)[1]
        correct += pred.eq(target.data.view_as(pred)).cuda().sum()
    test_loss /= len(test_loader.dataset)
    print('\nTest set:Average loss:{:.4f},Accuracy:{}/{}  ({:.0f}%)\n'.format(
        test_loss,correct,len(test_loader.dataset),
        100. *correct / len(test_loader.dataset)))

结果展示

for epoch in range(1,10):
    train(epoch)
    test()

在这里插入图片描述

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

1100dp

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值