DL深度学习
文章平均质量分 92
Westward-sun.
沉淀
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
BERT 模型深度解析:从 Transformer Encoder 到预训练语言理解模型
摘要 BERT(Bidirectional Encoder Representations from Transformers)是Google于2018年提出的预训练语言模型,通过在大规模无标注文本上预训练获得通用语言表示,可迁移到各类NLP任务。相比传统方法,BERT采用Transformer Encoder构建深层双向语义表示,通过Masked Language Model和Next Sentence Prediction两个预训练任务,使模型能同时利用上下文信息。本文系统解析了BERT的结构、输入表示原创 2026-05-08 09:26:37 · 935 阅读 · 0 评论 -
基于双向LSTM的中文情感分类实战:从数据预处理到实时预测
本文介绍了一个完整的中文文本情感分类项目,采用双向三层LSTM模型对微博评论进行四分类情绪识别(喜悦、愤怒、厌恶、低落)。项目包含数据预处理、词汇表构建、预训练词向量加载、模型训练与验证等完整流程。通过字符级分词处理,构建4762个词汇的词典,使用腾讯200维预训练词向量,设计包含嵌入层、双向LSTM和全连接层的网络结构。实验结果显示该模型能有效识别文本情感,并提供了交互式预测脚本。文章详细解析了核心代码实现,包括数据批处理、模型架构和训练策略,为文本分类任务提供了可复用的技术方案。原创 2026-04-20 22:25:33 · 631 阅读 · 3 评论 -
PyTorch迁移学习实战:用ResNet18实现20类食物图像分类(附代码详解)
迁移学习是一种将预训练模型的知识迁移到新任务的机器学习方法。文章详细介绍了迁移学习的核心概念、应用场景和实现策略,包括特征提取和微调两种主要方法。通过PyTorch代码示例展示了如何使用ResNet18进行迁移学习,包括模型加载、层替换、数据预处理和训练流程。关键点包括:1)冻结预训练层参数;2)替换全连接层适配新任务;3)合理设置学习率和优化器;4)使用数据增强防止过拟合。实验表明迁移学习能显著提升小数据集的模型性能,相比从头训练可提高30%以上的准确率。文章还给出了保存最佳模型、设置随机种子等优化建议,原创 2026-04-18 22:27:09 · 981 阅读 · 0 评论 -
深入理解 ResNet:解决深度学习退化问题的经典网络
ResNet(残差网络)是深度学习领域的里程碑式创新,解决了深度神经网络训练中的退化问题。通过引入批量归一化(BN)和残差结构两大关键技术,ResNet实现了超深度网络的有效训练。其核心思想是利用shortcut连接让信息跨层传递,使网络只需学习输入与输出之间的残差,大大降低了训练难度。ResNet支持18层到152层等多种深度版本,具有收敛快、泛化强、通用性好等优势,成为计算机视觉领域最广泛使用的基础模型之一。这项简洁而优雅的设计不仅开创了深度学习"深度为王"的新时代,更启发了后续众多原创 2026-04-17 07:00:00 · 1319 阅读 · 0 评论 -
深入理解LSTM:从结构到PyTorch实践
文章摘要 LSTM(长短期记忆网络)是一种改进的循环神经网络(RNN),由Hochreiter和Schmidhuber于1997年提出,旨在解决传统RNN处理长序列时的梯度消失问题。其核心机制包括遗忘门、输入门和输出门,通过细胞状态(Cell State)选择性记忆或遗忘信息,从而捕捉远距离依赖关系。LSTM在自然语言处理和时间序列任务中表现优异,但计算复杂度较高且难以并行化。PyTorch提供了高效的LSTM实现模块,支持多层堆叠和灵活的参数配置。尽管Transformer等新模型崛起,LSTM仍在小规模原创 2026-04-15 06:00:00 · 964 阅读 · 0 评论 -
循环神经网络(RNN)入门:核心概念、词嵌入与 PyTorch 实现
循环神经网络(RNN)是处理序列数据的深度学习模型,通过循环结构保留历史信息。RNN的核心是隐藏状态,它存储历史信息并用于当前计算。RNN广泛应用于自然语言处理、时间序列预测等领域。文本处理需先通过词嵌入层将单词转为向量,PyTorch的nn.Embedding可实现这一功能。RNN虽能处理序列数据,但存在梯度消失/爆炸问题,实际应用中常被LSTM或GRU替代。本文介绍了RNN的基本原理和PyTorch实现,为学习更复杂的循环网络奠定基础。原创 2026-04-14 13:00:00 · 787 阅读 · 0 评论 -
NLP 词向量实战:PyTorch 从零实现 CBOW(Word2Vec)全流程拆解
本文详细拆解了工业级CBOW词向量模型的完整实现流程。基于PyTorch框架,从文本预处理、词汇表构建到模型训练与推理,严格遵循深度学习规范。文章重点介绍了CBOW模型的核心逻辑、代码实现细节(包括词嵌入层、词向量求和等关键操作)以及训练收敛验证。同时提供了词向量提取保存方法和常见问题解决方案,确保代码开箱即用。通过上下文预测中心词的任务验证,模型成功学习到有效的语义信息。所有实现均规避了新手常见错误,可直接应用于文本分类、情感分析等下游NLP任务。原创 2026-03-30 17:28:02 · 637 阅读 · 0 评论 -
CNN 核心知识点详解:从图像基础到卷积与池化
本文系统介绍了卷积神经网络(CNN)的基础理论。首先阐述了图像基础知识,包括像素、颜色通道和常见图像类型。然后重点讲解了CNN的核心组件:卷积层通过局部连接和权重共享提取特征,涉及卷积计算、填充、步长和多通道处理;池化层则通过最大/平均池化实现降维和特征抽象。文章还介绍了CNN经典架构及其在图像处理中的应用。这些理论为后续CNN实战应用奠定了坚实基础,下一篇将结合PyTorch实现卷积和池化操作并进行可视化分析。原创 2026-03-21 20:40:31 · 1127 阅读 · 0 评论 -
CNN入门:MNIST手写数字识别(附完整可运行代码)
本文详细介绍了使用PyTorch构建CNN模型完成MNIST手写数字识别的完整流程。通过3个卷积模块和1个全连接层组成的网络结构,实现了98.54%的测试准确率。文章从数据加载、模型定义、训练测试等方面进行逐步讲解,重点分析了卷积神经网络相比全连接网络的优势,包括局部感受野、参数共享和池化下采样等特性。同时深入解释了关键API如view、item、argmax的作用,以及训练与测试模式的区别。完整代码可直接运行,为初学者提供了理解CNN工作原理的实践案例,也为后续学习更复杂模型奠定了基础。原创 2026-03-21 19:41:48 · 2730 阅读 · 0 评论 -
PyTorch入门实战:MNIST手写数字识别(全连接神经网络详解)
本文介绍了使用PyTorch构建全连接神经网络(MLP)实现MNIST手写数字分类的完整流程。主要内容包括:1)加载并可视化MNIST数据集;2)构建包含两个隐藏层的神经网络模型;3)使用交叉熵损失和Adam优化器;4)训练10个epoch后测试准确率达到97%以上。文章详细解释了数据预处理、模型构建、训练测试等关键步骤,并提供了完整可运行的代码,适合深度学习初学者入门参考。最后还提出了改进方向,如使用CNN、调整超参数和数据增强等。原创 2026-03-20 23:30:34 · 1049 阅读 · 1 评论 -
【Python+PyTorch】从零实现食物识别:自动生成标注 + CNN 训练全流程
本文介绍了一个简易食物图像分类系统的实现过程,适合深度学习初学者。系统核心功能包括:自动遍历数据集目录生成标注文件、自定义Dataset类加载数据、搭建轻量化CNN模型以及完整的训练测试流程。项目亮点在于:1) 自动化生成训练/测试标注文件;2) 详细注释的代码实现;3) 专为CPU环境优化,轻薄本即可运行;4) 健壮的异常处理机制。文章详细讲解了数据预处理、模型架构、训练测试等关键环节的实现方法,并提供了常见问题解决方案和模型优化思路。该项目可直接复用,只需替换数据集路径和类别数即可适配其他分类任务,非常原创 2026-03-11 15:28:54 · 998 阅读 · 0 评论
分享