- 博客(34)
- 收藏
- 关注
原创 Day 34:Transformer与ViT — 从Attention到Vision Transformer
<think>我们只需要根据给定内容生成一个摘要,不超过150字。内容是关于自注意力机制、Q/K/V、ViT实现的教程。摘要应简洁概括关键要点:从CNN与Transformer对比,到核心知识点涵盖QKV、多头注意力、位置编码等。注意字数控制。</think>本文对比CNN局部性与Transformer全局性,详解自注意力Q/K/V计算与缩放点积原因,并给出单头、多头注意力PyTorch实现,为从零实现ViT奠定核心基础。
2026-09-03 16:15:19
182
原创 Day 33:目标跟踪基础 — SORT与DeepSORT
<think>我们只需要根据内容生成≤150字的摘要。内容是关于目标跟踪的技术文章,包括卡尔曼滤波、匈牙利匹配、ReID等概念,从SORT到DeepSORT的进化,以及从零实现简单跟踪器。需要将核心信息浓缩成≤150字的中文摘要。 关键词:目标跟踪、卡尔曼滤波、匈牙利匹配、ReID、SORT、DeepSORT、Tracking-by-Detection、实现。摘要要简洁概括。</think>本文介绍了目标跟踪的核心组件(卡尔曼滤波、匈牙利匹配、ReID),梳理从SORT到DeepSORT的演进思路,并演示了
2026-09-02 17:11:51
351
原创 Day 32:DeepLab系列与语义分割进阶
<think>我们继续。需要根据内容生成摘要,≤150字。汇总空洞卷积与ASPP核心,DeepLab进化,torchvision应用。摘要要求简短。用户原始要求:"根据以下内容,生成≤150字的文章摘要"。内容为笔记形式。需提取要点。</think>本文聚焦语义分割中感受野与分辨率的矛盾,介绍空洞卷积在保持分辨率同时扩大感受野的原理,DeepLab v1对此的首次应用,以及v2中ASPP多尺度并行提取的贡献,并延伸至v3+进化,使用torchvision实现语义分割。
2026-09-02 17:05:02
245
原创 Day 31:图像分割 — FCN与U-Net
文章摘要: 本文介绍了语义分割的核心概念与主流模型FCN和U-Net。语义分割是像素级分类任务,输出与原图大小相同的标签图。FCN通过全卷积化、上采样和跳跃连接将分类网络改造为分割网络,解决了分辨率丢失问题。U-Net采用对称编码器-解码器结构,通过跳跃连接融合浅层细节与深层语义信息,成为医学影像等领域的基准模型。文章对比了三种分割任务(语义、实例、全景),演示了转置卷积的上采样原理,并提供了U-Net的PyTorch实现代码框架,适合端侧AI应用如自动驾驶、工业质检等场景。
2026-08-25 18:38:16
200
原创 Day 30:第二阶段总结与自测 — 深度学习入门
摘要: 本文回顾了深度学习14天学习内容,涵盖基础概念、PyTorch框架、CNN网络、训练技巧和目标检测入门。通过30道自测题检验掌握程度,重点考察梯度计算、反向传播、激活函数、PyTorch使用规范、卷积计算等核心知识点。当前学习进度30%,即将进入计算机视觉核心任务阶段。题目设置包含典型陷阱与高频考点,配套答案详解帮助定位知识盲区。
2026-08-25 18:35:48
168
原创 Day 26:数据增强技术 — 让模型更鲁棒
掌握从基础几何变换到MixUp/CutMix的完整数据增强体系,学会用数据增强白嫖准确率:10分钟 |:40分钟。
2026-08-21 18:35:45
180
原创 Day 25:深度学习训练技巧全攻略
本文介绍了深度学习模型训练中的核心优化技巧,重点讲解了学习率调度策略。主要内容包括: 训练技巧全景图:展示了包括学习率调度、优化器选型、精度与内存优化等在内的完整训练工具箱。 学习率调度详解: 对比了StepLR、CosineAnnealing、OneCycleLR等6种常用调度器 提供了Warmup实现代码及其重要性说明 给出调度器选型指南,推荐CosineAnnealingLR作为通用方案 代码实践: 包含完整的PyTorch实现代码 可视化不同调度器的学习率变化曲线 强调Warmup对训练稳定性的重要
2026-08-20 16:47:31
299
原创 Day 24:GoogLeNet与Inception — 多尺度特征融合
本文介绍了Inception模块的设计哲学及其在GoogLeNet中的应用。Inception通过并行使用不同尺度的卷积核(1×1、3×3、5×5)和池化层来捕捉多尺度特征,并通过1×1卷积降维大幅减少计算量。文章详细对比了朴素Inception与优化版本的计算效率差异,展示了1×1卷积的"bottleneck"设计如何将5×5分支参数量减少90%。此外,还介绍了Inception v2/v3的改进,包括将大卷积核分解为小卷积堆叠(5×5→两个3×3)和空间可分离卷积(3×3→1×3+3×1),进一步提升了
2026-08-20 16:44:21
307
原创 Day 23:ResNet与残差连接 — 终结梯度消失
本文介绍了残差网络(ResNet)的核心思想和实现方法。主要内容包括: 退化问题分析:指出深度神经网络并非层数越深效果越好,存在梯度消失和恒等映射难以学习的问题。 残差学习原理:通过残差连接(F(x)+x)使网络更容易学习恒等映射,保证梯度至少为1,解决梯度消失问题。 关键组件实现: BasicBlock(用于ResNet-18/34):两个3×3卷积+残差连接 Bottleneck(用于ResNet-50/101/152):1×1降维→3×3卷积→1×1升维,大幅减少参数量 网络架构:包含初始卷积层、最大
2026-08-19 17:30:30
353
原创 Day 22:经典CNN架构 — LeNet到VGG
本文梳理了CNN经典架构的进化历程,重点解读了LeNet-5和AlexNet两个里程碑模型。LeNet-5(1998)作为首个CNN,确立了"卷积-池化-全连接"的范式,证明了端到端学习的可行性。AlexNet(2012)则通过ReLU激活函数、Dropout和数据增强等创新,在ImageNet竞赛中取得突破,开启了深度学习革命。文章通过PyTorch代码实现展示了两个模型的结构特点,并分析了它们解决的关键问题:LeNet-5验证了卷积网络的有效性,AlexNet则解决了深度网络训练难题。这些突破为后续VG
2026-08-19 17:27:15
258
原创 Day 21:卷积神经网络CNN — 深入理解卷积
摘要:本文系统讲解了卷积神经网络的核心原理与实践。首先对比全连接层与卷积层的参数效率(224×224图像全连接层参数量达1.54亿,卷积层通过参数共享、局部连接和平移不变性显著优化)。然后从数学本质出发,用Python实现2D卷积(含边缘检测示例),详细解析stride/padding/dilation等参数对输出尺寸的影响(附公式)。通过VGG16案例演示感受野计算(最终达212×212),并对比各类卷积变体:标准卷积参数量计算(3×3×64核参数量1,792)、分组卷积、深度可分离卷积等。最后给出端侧A
2026-08-18 11:26:03
281
原创 Day 20:构建第一个真实神经网络 — 图像分类实战
本文介绍了一个完整的CIFAR-10图像分类项目流程。主要内容包括: 数据准备:使用PyTorch加载CIFAR-10数据集,并对训练数据应用随机裁剪、水平翻转和颜色抖动等增强方法,验证数据仅做归一化处理。 模型设计:构建了一个经典CNN架构,包含3个卷积块(每个块由Conv-BN-ReLU-Conv-BN-ReLU-Pool组成),通道数从32逐步增加到128,最后接全连接分类头。 训练流程:配置了AdamW优化器、交叉熵损失函数和余弦退火学习率调度器,并实现了早停机制。 该项目完整实现了从数据准备到模型
2026-08-18 10:56:08
269
原创 Day 19:PyTorch入门(下)— nn.Module与训练流程
本文介绍了PyTorch深度学习的四大核心组件:模型构建(nn.Module)、数据加载(Dataset/DataLoader)、损失函数和优化器。主要内容包括:1)如何通过继承nn.Module自定义神经网络模型;2)常用层的用法速查(线性层、卷积层、归一化层等);3)使用nn.Sequential快速搭建网络;4)创建自定义Dataset和配置DataLoader进行高效数据加载。掌握这四个核心组件即可构建完整的深度学习训练流程。文章提供了大量代码示例,适合PyTorch初学者快速入门核心功能。
2026-08-17 15:49:19
311
原创 Day 18:PyTorch入门(上)— Tensor操作与自动求导
本文介绍了PyTorch中Tensor的核心用法,包括创建、索引、运算、GPU加速和属性操作。主要内容有: Tensor创建:7种创建方式(列表/NumPy转换、特殊矩阵、指定类型/设备等),附数据类型对照表。 Tensor属性与操作:shape/dtype/device等属性查看,索引切片、形状变换(reshape/flatten)、拼接(cat/stack)等操作。 Tensor运算:支持逐元素运算、数学函数、矩阵乘法和广播机制,语法与NumPy相似。 GPU加速:通过.cuda()或.to()方法实现
2026-08-17 14:38:28
276
原创 Day 17:神经网络基础 — 前向传播与反向传播
本文介绍了深度学习中的核心算法——反向传播,通过计算图和链式法则实现网络参数的梯度计算。主要内容包括:1)计算图的概念和前向/反向传播流程;2)链式法则的数学原理及其在神经网络中的应用;3)手动推导两层网络的反向传播过程,包括线性层和ReLU激活函数的梯度计算;4)常见神经网络层的梯度公式总结(线性层、ReLU、Sigmoid等),特别强调Softmax+交叉熵组合的简洁梯度形式;5)梯度检验方法,通过数值梯度验证解析梯度的正确性。文章采用代码示例与数学公式相结合的方式,帮助读者从零实现反向传播框架,深入理
2026-08-14 10:18:50
172
原创 Day 16:深度学习概述 — 从传统ML到神经网络
深度学习入门指南:核心概念与实践要点 本文系统介绍了深度学习的基础知识,重点对比了传统机器学习与深度学习的本质差异。深度学习通过端到端学习自动提取特征,2012年后因数据规模、算力提升和算法突破(如ReLU、Dropout)迎来爆发。文章详细解析了神经网络的核心组件:神经元(线性变换+激活函数)、激活函数(引入非线性)、全连接层(矩阵运算)以及损失函数(预测评估)。通过Python代码演示了神经网络的实现原理,包括前向传播和反向传播过程。最后提供了端侧AI场景下的激活函数选型建议,为初学者构建了清晰的学习框
2026-08-14 10:10:18
217
原创 Day 15:第一阶段总结与自测 — 基础夯实,检验成果
摘要:本文总结了15天机器学习入门第一阶段的成果,涵盖Python环境搭建、NumPy、OpenCV、线性代数、概率统计、机器学习基础等内容。通过知识体系全景图展示各模块关联,并提供30道自测试题(每题1分),检验读者对关键概念的掌握情况。测试题包括选择题和代码输出题,涉及环境配置、数组操作、图像处理、数学基础、模型评估等重点知识点,为后续深度学习学习打下基础。
2026-08-13 14:46:58
215
原创 Day 14:Linux基础与GPU环境配置 — 从Windows到Linux的实战跳跃
文章摘要:本文为AI工程师提供了Linux环境下的核心操作指南,重点涵盖四大技能:1)必会的30个Linux命令(文件操作、文本处理、资源监控等);2)CUDA/cuDNN版本管理与PyTorch环境配置技巧;3)Docker容器化部署(含NGC镜像推荐和GPU挂载方法);4)SSH远程连接与tmux会话保持技术。内容包含实操代码示例和版本对应表格,帮助开发者快速掌握生产环境中的关键运维技能,解决AI模型训练/部署中的环境问题。
2026-08-13 14:44:05
224
原创 Day 13:过拟合与正则化 — 告别过拟合的武器库
本文介绍了四种防止过拟合的核心技术:L1/L2正则化、Dropout、早停法和数据增强。通过代码示例展示了L1/L2正则化如何限制权重,L1产生稀疏解适合特征选择,L2使权重均匀缩小;Dropout在训练时随机关闭神经元,防止神经元过度依赖;早停法通过验证集监控提前终止训练;数据增强则通过扩充训练样本提升泛化性。这些方法在端侧AI中尤为重要,因为小模型更容易过拟合。文章提供了各技术的实现代码和端侧应用建议(如L2的weight_decay常用1e-4,Dropout在全连接层后常用p=0.5),帮助开发者在
2026-08-12 14:32:03
281
原创 Day 12:模型评估指标 — 再也不用“准确率“评价一切
这篇文章介绍了机器学习中常用的评估指标及其应用场景,主要内容包括: 准确率的局限性:在数据不平衡时准确率会误导判断 混淆矩阵:TP/TN/FP/FN四个基础概念及其实现 四大核心指标: 精确率(Precision):预测为正的正确率 召回率(Recall):真实正例被检出的比例 F1-Score:精确率和召回率的调和平均 特异度(Specificity):真实负例被正确识别的比例 ROC曲线与AUC:通过不同阈值下的TPR和FPR全面评估模型性能 PR曲线:适用于类别不平衡场景的评估方法 文章通过Pytho
2026-08-12 14:27:21
273
原创 Day 11:经典ML算法 — SVM与决策树
本文介绍了机器学习中SVM和决策树的核心原理与应用。SVM通过最大化间隔寻找最优分类超平面,小样本高维场景表现优异,核函数可处理非线性数据,Hinge Loss实现高效训练。决策树基于信息增益或基尼系数进行特征分裂,构建可解释规则,适合风控等场景。随机森林通过集成多棵决策树提升泛化能力。这些经典算法因计算效率高、模型轻量,在端侧AI和工业界仍有重要地位。文中包含Python代码实现,帮助理解核心数学原理和实际应用技巧。
2026-08-10 15:10:31
345
原创 Day 10:经典ML算法 — 线性回归与逻辑回归
本文介绍了如何从零推导并实现线性回归和逻辑回归,这两种基础模型是深度学习的核心组成部分。文章首先解释了线性模型在神经网络中的基础地位,然后详细推导了两种模型的数学原理和梯度下降实现过程。对于线性回归,提供了梯度下降和正规方程两种实现方式;对于逻辑回归,重点讲解了Sigmoid函数和交叉熵损失的计算方法。通过完整的代码实现和数学推导,帮助读者深入理解参数更新机制和模型优化过程,为后续学习更复杂的神经网络模型打下坚实基础。
2026-08-10 15:05:36
492
原创 Day 9:机器学习基础概念 — 建立AI知识体系的顶层框架
理解监督/无监督/强化学习三大范式,彻底搞懂偏差-方差权衡,建立起AI知识体系的第一层框架:8分钟 |:30分钟。
2026-08-07 09:31:55
379
原创 Day 8:概率论与统计 — 分布、贝叶斯、最大似然估计
理解概率分布、贝叶斯定理、最大似然估计,搞懂损失函数和模型不确定性背后的数学原理:8分钟 |:30分钟。
2026-08-07 09:29:02
334
原创 Day 6:线性代数回顾(上)— 向量、矩阵、特征值分解
本文介绍了线性代数在深度学习中的核心应用,重点讲解了向量运算、矩阵乘法和特征值分解等关键概念。主要内容包括: 向量运算:点积、范数计算和余弦相似度,这些是神经网络全连接层和正则化的数学基础。 矩阵运算:矩阵乘法、转置和逆矩阵,这些操作构成了神经网络前向传播的核心计算。 特征值分解:解释了特征值和特征向量的概念及其在PCA降维中的应用。 实战部分:展示了如何用NumPy实现线性层的前向计算,包括权重初始化和矩阵乘法运算。 文章通过代码示例直观展示了这些数学概念在深度学习中的具体应用,帮助读者理解神经网络底层的
2026-08-06 11:46:39
307
原创 Day 5:OpenCV图像处理基础(下)— 滤波、边缘检测、形态学操作
图像处理铁三角实战指南 本文介绍了传统CV中滤波降噪、边缘检测和形态学操作三大核心技术的组合应用。 关键内容: 滤波降噪:对比高斯/中值/双边滤波的适用场景,高斯滤波通用性最佳,中值滤波擅长处理椒盐噪声 边缘检测:详解Sobel/Laplacian/Canny原理,Canny通过双阈值和非极大值抑制获得最清晰边缘 形态学操作:开闭运算组合使用可消除噪点/连接断裂,梯度运算能提取物体轮廓 完整流程:演示了从降噪→边缘检测→形态学优化→轮廓提取的经典目标分割pipeline,包含参数调优技巧和效果对比。 适用场
2026-08-05 09:42:15
285
原创 Day 4:OpenCV图像处理基础(上)— 图像读写、色彩空间、几何变换
本文介绍了OpenCV在AI工程中的核心应用,重点讲解了图像预处理的关键技术: 基础操作:图像读写(注意BGR格式)、属性获取和显示方法 色彩空间转换:BGR与RGB/GRAY/HSV/Lab的转换场景及选择指南 几何变换:缩放(含插值方法)、裁剪、翻转、旋转和仿射变换 可视化工具:绘制线条、矩形、圆形、文字和多边形的方法 实战案例:演示了YOLO风格的预处理流程,包含letterbox缩放和归一化 核心要点: OpenCV默认BGR格式(与常见RGB不同) 图像处理是AI模型训练/推理的基础环节 掌握色彩
2026-08-05 09:34:41
276
原创 Day 3:NumPy高效数值计算 — AI工程师的底层基石
本文系统介绍了NumPy在AI开发中的核心应用,重点包括:1)NumPy数组与Python列表的本质区别;2)7种数组创建方式;3)高效索引与切片技巧;4)广播机制的原理与实战应用;5)向量化编程对性能的显著提升(比for循环快50倍)。文章通过图像归一化、Softmax实现、模拟卷积等AI典型场景,演示了NumPy的高效用法,并强调它是PyTorch/TensorFlow等框架的底层基础。最后提供了常用函数速查表,帮助开发者快速掌握这一AI必修工具。
2026-08-04 12:08:55
333
原创 Day 2:Python环境搭建与必备库 — Conda环境、pip、虚拟环境管理
彻底搞懂Conda环境管理,配好pip国内镜像,从此装库不再报错
2026-08-04 09:22:23
424
原创 Day 1:开篇 — 端侧AI算法工程师的100天成长之路
摘要:本文介绍了100天端侧AI学习计划的第一天内容。课程聚焦2024年AI行业趋势,强调端侧AI(如Apple Intelligence、高通骁龙AI)的重要性,并提出"端侧AI算法工程师=模型+优化+部署"的核心能力。100天学习分为7个阶段,从Python基础到模型部署(YOLO/TensorRT/Jetson),最终完成3个实战项目。首日任务包括搭建开发环境(Miniconda+PyTorch+OpenCV)和建立学习心态(每日手敲代码、单点突破、输出分享)。计划适合有Python基础的学习者
2026-08-03 19:05:25
455
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅