- 博客(4)
- 收藏
- 关注
原创 从“单字接龙”到看懂世界:视觉大模型与 ViT 完全指南
从文本的单字接龙,到图像的 Patch 切分,Transformer 架构凭借其简洁与通用性,成功一统了 NLP 与 CV 的江湖。理解了 ViT,你就拿到了通往多模态大模型时代最关键的一把钥匙。
2026-06-08 11:24:58
196
原创 深入理解 Transformer 模型:从原理到架构的全面解析
2017年,Google 团队发表了轰动一时的论文《Attention Is All You Need》。这篇论文正式提出了 Transformer 模型,它摒弃了传统的循环(RNN)和卷积(CNN)结构,完全基于注意力机制构建,彻底改变了深度学习的发展轨迹。:能够有效捕捉输入序列中间隔较长的语义关联。:可以充分利用分布式 GPU 进行并行训练,极大地提升了模型的训练效率。下面,我们将从数据的输入开始,一步步拆解 Transformer 的完整工作流。
2026-06-01 09:00:00
327
原创 卷积神经网络(CNN)与深度学习视觉应用综述
在深度学习领域,卷积神经网络(CNN)是实现计算机视觉任务的基石。通过对这些基础理论的学习,我们能够构建起从特征提取到复杂场景理解的知识体系。
2026-05-24 19:25:52
188
原创 从线性回归到卷积神经网络:神经网络入门的一条主线
本文系统梳理了神经网络的发展脉络:从线性回归和分类的基础模型出发,逐步引入感知机、多层网络和BP算法,最终发展为卷积神经网络。文章揭示了神经网络演化的内在逻辑:从简单线性拟合到复杂非线性建模,从全连接到局部连接,始终围绕模型表达、误差定义和参数更新三个核心问题展开。特别强调了BP算法作为训练框架的通用性,以及CNN针对图像特性的结构创新。这种渐进式的学习路径有助于理解深度学习并非"黑箱",而是传统机器学习思想的自然延伸。
2026-05-17 15:47:52
510
1
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅