自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(4)
  • 收藏
  • 关注

原创 从“单字接龙”到看懂世界:视觉大模型与 ViT 完全指南

从文本的单字接龙,到图像的 Patch 切分,Transformer 架构凭借其简洁与通用性,成功一统了 NLP 与 CV 的江湖。理解了 ViT,你就拿到了通往多模态大模型时代最关键的一把钥匙。

2026-06-08 11:24:58 196

原创 深入理解 Transformer 模型:从原理到架构的全面解析

2017年,Google 团队发表了轰动一时的论文《Attention Is All You Need》。这篇论文正式提出了 Transformer 模型,它摒弃了传统的循环(RNN)和卷积(CNN)结构,完全基于注意力机制构建,彻底改变了深度学习的发展轨迹。:能够有效捕捉输入序列中间隔较长的语义关联。:可以充分利用分布式 GPU 进行并行训练,极大地提升了模型的训练效率。下面,我们将从数据的输入开始,一步步拆解 Transformer 的完整工作流。

2026-06-01 09:00:00 327

原创 卷积神经网络(CNN)与深度学习视觉应用综述

在深度学习领域,卷积神经网络(CNN)是实现计算机视觉任务的基石。通过对这些基础理论的学习,我们能够构建起从特征提取到复杂场景理解的知识体系。

2026-05-24 19:25:52 188

原创 从线性回归到卷积神经网络:神经网络入门的一条主线

本文系统梳理了神经网络的发展脉络:从线性回归和分类的基础模型出发,逐步引入感知机、多层网络和BP算法,最终发展为卷积神经网络。文章揭示了神经网络演化的内在逻辑:从简单线性拟合到复杂非线性建模,从全连接到局部连接,始终围绕模型表达、误差定义和参数更新三个核心问题展开。特别强调了BP算法作为训练框架的通用性,以及CNN针对图像特性的结构创新。这种渐进式的学习路径有助于理解深度学习并非"黑箱",而是传统机器学习思想的自然延伸。

2026-05-17 15:47:52 510 1

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除