自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(174)
  • 收藏
  • 关注

原创 LangChain最详细教程之Model IO(一)调用模型

本文摘要: 本文系统介绍了LangChain框架中的Model I/O模块,重点讲解了大语言模型调用的核心方法与技巧。内容涵盖:1) Model I/O模块的三大核心组件(输入提示、模型调用、输出解析);2) 模型分类方式(按功能分为LLMs、ChatModels、EmbeddingModels);3) 参数配置方法(硬编码、环境变量、配置文件);4) 多平台API调用示例(OpenAI、百度千帆);5) 消息类型(SystemMessage、HumanMessage等)与多轮对话实现;6) 多种调用方式(

2026-03-25 21:07:18 572

原创 LangChain最详细教程之使用概述(三)

本文是LangChain框架的入门教程,系统介绍了该框架的核心功能模块。首先从基础的大模型调用开始,演示了如何通过API密钥连接GPT模型。接着详细讲解了提示词模板、输出解析器的使用方法,并展示了向量存储和RAG(检索增强生成)的实现过程。教程还包含Agent的创建与执行示例,以及如何获取DeepSeek等平台的API密钥。整个教程采用"helloworld"式的渐进教学法,从简单调用逐步深入到复杂功能实现,为开发者提供了全面的LangChain入门指南。

2026-03-25 21:06:16 403

原创 LangChain最详细教程之使用概述(二)

本文系统介绍了大语言模型应用开发的核心架构和LangChain框架的六大组件。重点解析了RAG(检索增强生成)和Agent两种主流开发模式,RAG通过检索外部知识提升回答准确性,Agent则通过规划、记忆和工具调用实现智能决策。文章详细阐述了LangChain的Model I/O、Chains、Memory、Agents、Retrieval和Callbacks六大核心模块功能,为开发者提供了从基础到进阶的完整技术路线图。该教程旨在帮助开发者掌握大模型应用开发的关键技术,实现高效落地的AI解决方案。

2026-03-24 14:05:41 452

原创 LangChain最详细教程之使用概述(一)

本文介绍了LangChain这一流行的大语言模型应用开发框架。文章从三个部分展开:首先概述LangChain的背景、功能和优势,它由哈佛大学Harrison Chase开发,能简化LLM应用的构建流程;其次详细解析其架构设计,包括核心组件、LangGraph扩展和配套工具LangSmith/LangServe;最后列出开发前的预备知识要求。文章指出LangChain通过标准化接口和模块化设计,降低了LLM应用开发门槛,其核心价值在于提供了一套完整的AI应用组装工具集,特别在智能体开发和运维监控方面具有独特优

2026-03-21 13:50:29 921

原创 计算机视觉进阶教学之Mediapipe库(二)

上一篇博客我们讲述了关于Mediapipe简介,以及讲述了手部识别与手势识别,今天我们就来看看我们自定义手势是如何完成的计算机视觉进阶教学之Mediapipe库(一)# 手势类别:键为数字(对应键盘按键),值为手势名称0: "fist", # 拳头1: "open_hand", # 张开的手2: "point", # 指向(单指)3: "peace", # 剪刀手(双指)4: "ok" # OK手势DATA_DIR = "gesture_data" # 总数据目录名称。

2026-03-21 12:58:43 643

原创 计算机视觉进阶教学之Mediapipe库(一)

本文介绍了Google开源项目Mediapipe在Python环境下的安装与应用,重点演示了手部检测和手势识别功能。通过Mediapipe的Hands模块,可实时检测手部21个关键点并绘制连接关系。手势识别部分通过计算手指关键点间的距离,判断手指伸直状态并计数,实现0-10数字手势的识别。该系统支持双手检测,具有实时性强、跨平台等特点,适用于人机交互等场景。安装只需通过pip安装mediapipe和opencv库即可快速搭建开发环境。

2026-03-20 23:18:54 820

原创 计算机视觉进阶教学之Dlib库(三)

本文介绍了基于CNN卷积神经网络的人脸识别方法。首先讲解了CNN的核心概念,包括卷积层、池化层、激活函数和全连接层的工作原理。接着详细说明了实现步骤:加载预训练模型、人脸检测、特征提取和相似度比较。最后提供了使用dlib库实现CNN人脸检测的代码示例,该方法比传统Haar级联检测更精确,但计算复杂度更高,适合单张图片的人脸检测任务。

2026-03-19 23:30:27 197

原创 计算机视觉系列进阶教学之dlib库(二)

在计算机视觉的进阶学习中,dlib 库是一款不可多得的 “瑞士军刀”—— 它以简洁的 API 封装了复杂的机器视觉算法,尤其在人脸分析、特征提取等领域表现突出,既能满足科研实验的快速验证需求,也能支撑工业级项目的落地开发。如果你已经掌握了 OpenCV 的基础操作,却在人脸关键点定位、疲劳检测、人脸追踪等进阶场景中感到困惑,那么这篇系列教学将为你搭建从 “基础” 到 “实战” 的桥梁。上一篇博客我们讲了dlib库实现表情识别与疲劳检测,今天我们来进行性别年龄的预测计算机视觉进阶教学之dlib库(一)

2026-03-19 23:17:23 412

原创 计算机视觉系列进阶教学之dlib库(一)

在计算机视觉的进阶学习中,dlib 库是一款不可多得的 “瑞士军刀”—— 它以简洁的 API 封装了复杂的机器视觉算法,尤其在人脸分析、特征提取等领域表现突出,既能满足科研实验的快速验证需求,也能支撑工业级项目的落地开发。如果你已经掌握了 OpenCV 的基础操作,却在人脸关键点定位、疲劳检测、人脸追踪等进阶场景中感到困惑,那么这篇系列教学将为你搭建从 “基础” 到 “实战” 的桥梁。

2026-03-19 22:59:06 442

原创 计算机视觉系列进阶教学之颜色识别(HSV)

本文介绍了基于HSV颜色模型进行图像颜色检测的方法。HSV模型通过色调(H)、饱和度(S)和明度(V)三个参数直观表示颜色特性。文章展示了两种实现方案:方案一通过遍历固定矩形区域的像素H值判断主颜色(红黄绿蓝),适用于简单分类;方案二使用cv2.inRange()创建掩码检测整个画面中特定颜色范围(如绿色或棕色)的像素并高亮显示,效率更高且适用于复杂场景。两种方案各有优缺点,可根据具体需求选择使用。HSV模型相比RGB能更直观地进行颜色分析和处理。

2026-03-13 21:38:10 469

原创 计算机视觉进阶教学之人脸识别

人脸识别技术通过计算机算法提取人脸特征并进行身份匹配,主要流程包括人脸检测、特征提取和特征匹配。OpenCV提供了三种特征提取算法:LBPH算法通过局部二值模式直方图提取纹理特征,具有抗光照、旋转等优势;EigenFaces算法基于PCA降维保留主要特征信息;FisherFaces算法采用LDA分析,优化类间区分度。三种算法各有特点,LBPH实现简单且鲁棒性强,EigenFaces和FisherFaces则通过降维提高识别效率。代码示例展示了各算法的具体实现过程,包括数据预处理、模型训练和预测识别,并解决了

2026-03-11 19:24:32 391

原创 计算机视觉系列进阶教学之人脸检测

本文介绍了基于OpenCV的人脸检测和微笑检测方法。首先阐述了人脸检测原理,包括Haar特征提取和级联分类器的工作原理,并提供了Python代码实现人脸检测的具体步骤。随后在检测到人脸的基础上,进一步介绍了微笑检测的实现方法,通过加载预训练的Haar级联分类器模型,可以实时检测摄像头画面中的人脸微笑状态。文章详细说明了相关参数设置和优化技巧,为计算机视觉初学者提供了实用的参考方案。

2026-03-11 14:10:54 418

原创 计算机视觉进阶教学之DNN模块

本文介绍了OpenCV中DNN模块的功能及实现图像风格迁移的代码实现。DNN模块支持加载多种深度学习框架的预训练模型,具有轻量、低依赖性等特点。代码部分详细展示了图像预处理、模型加载、推理和结果处理的全流程,包括静态图像处理和实时摄像头风格迁移两种实现方式。通过blobFromImage函数将图像转换为神经网络输入格式,使用预训练模型实现《星月夜》风格转换,并处理输出结果进行显示。该实现可用于静态图像和实时视频流的艺术风格转换。

2026-03-11 13:49:21 395

原创 计算机视觉进阶教学之背景建模与光流估计

本文介绍了计算机视觉中动态视频分析的两大核心技术:背景建模与光流估计。背景建模部分详细讲解了帧差法、K近邻和高斯混合三种方法,通过代码实现展示了如何从视频中分离前景目标。光流估计部分则利用Lucas-Kanade算法实现特征点跟踪,分析物体运动轨迹。这两种技术共同构成了动态场景理解的基础,可应用于交通监控、无人机追踪和自动驾驶等实际场景。文章通过Python代码示例演示了具体实现过程,为视频分析提供了实用解决方案。

2026-03-10 19:28:57 382

原创 计算机视觉进阶教学之图像投影(透视)变换

本文介绍了图像透视变换的原理及应用,重点展示了如何通过OpenCV实现文档图像校正。首先阐述了透视变换的定义、原理和典型应用场景,包括图像校正、虚拟现实等领域。随后通过一个票据校正案例详细演示了实现流程:包括辅助函数定义(坐标排序、透视变换等)、主程序执行(图像缩放、轮廓检测、最大轮廓提取)以及最终透视变换处理。案例采用Python+OpenCV实现,核心步骤包括获取文档边缘轮廓,应用四点透视变换将倾斜文档转换为正视图,并保存处理结果。该技术可广泛应用于各类文档扫描、图像校正场景。

2026-03-10 18:53:38 589

原创 OpenCV中透视与仿射变换的区别——从矩阵到实战的全面解析

对比维度仿射变换透视变换数学本质线性变换(无除法)非线性变换(需透视除法)矩阵形状2×33×3核心特性保持平行性打破平行性,模拟近大远小自由度6个8个所需对应点3个4个典型应用平移、旋转、缩放、错切文档矫正、鸟瞰图、车牌校正OpenCV接口仿射变换与透视变换的本质区别在于是否引入“透视除法”仿射是“平面游戏”,只有乘法和加法,适合简单的平移旋转;透视是“立体游戏”,多了除法步骤,能模拟真实世界的近大远小。

2026-03-10 14:12:22 676

原创 计算机视觉系列案例分享之实时文档扫描

本文介绍了一个实时文档扫描系统的实现方案。系统通过图像预处理(灰度化、高斯模糊、边缘检测)、轮廓检测(筛选四边形轮廓)、透视矫正(消除拍摄角度变形)和内容增强(二值化处理)四个核心技术步骤,将摄像头拍摄的纸质文档转化为清晰规整的电子图像。详细阐述了各环节的原理和OpenCV实现代码,包括辅助函数定义、主程序流程以及资源释放等完整实现过程。该系统解决了传统扫描仪便携性差、普通拍照变形等问题,实现了类似扫描仪效果的实时文档数字化处理。

2026-03-10 13:33:20 437

原创 计算机视觉系列案例分享之答题卡识别

本文介绍了一个基于OpenCV的答题卡识别系统实现流程。系统首先通过图像预处理(灰度化、去噪、边缘检测)获取答题卡轮廓,然后进行透视变换校正视角。接着通过阈值处理转为二值图像,识别答题区域。核心算法包括坐标点排序、透视变换和轮廓排序等辅助函数。最终通过比较选项区域像素值与标准答案实现自动评分。该系统实现了从图像采集到自动评分的完整流程,适用于标准化考试的自动阅卷场景。

2026-03-09 23:40:57 483

原创 机器学习项目分享之实现智能的矿物识别系统(二)

本文介绍了使用6种机器学习算法构建矿物识别系统的过程。首先对预处理后的数据集(平均数填充法)进行训练测试集划分,然后依次应用逻辑回归、随机森林、SVM、AdaBoost、XGBoost和高斯朴素贝叶斯模型。每个模型都经过网格搜索调参、训练评估,并提取各类别的召回率和整体准确率。最终XGBoost表现最优,后续将测试不同数据填充方法下的模型效果,以确定最佳数据处理方式和模型组合。所有模型结果以JSON格式保存,便于后续分析比较。

2026-03-09 12:51:49 558

原创 机器学习项目分享之实现智能的矿物识别系统(一)

本文介绍了矿物识别系统的数据处理流程,重点探讨了6种缺失值填充方法:空值删除、平均值/中位数/众数填充、线性回归和随机森林算法填充。详细说明了每种方法的实现步骤,包括训练集和测试集的分组处理策略。通过数据标准化、标签编码、类别平衡处理等预处理步骤,最终生成了12个不同填充方式的数据集文件,为后续机器学习模型训练提供高质量数据基础。文章强调数据清洗对模型性能的关键影响,并展示了从原始数据到模型可用数据的完整处理流程。

2026-03-08 23:55:35 308

原创 计算机视觉之多模板匹配

本文介绍了OpenCV中实现多目标模板匹配的方法。主要内容包括:1)多目标匹配的基本步骤(图像准备、预处理、执行匹配、定位区域);2)通过设置匹配阈值和遍历匹配点实现多目标检测;3)使用cv2.rotate生成不同旋转角度的模板,解决传统模板匹配无法识别旋转目标的局限性。文中提供了完整的Python代码示例,演示了如何检测图像中不同角度的箭头目标。该方法通过组合多角度模板匹配,有效提升了目标检测的鲁棒性。

2026-03-08 19:48:13 264

原创 计算机视觉进阶教学之特征检测

本文介绍了计算机视觉中三种关键特征检测技术及其应用。首先讲解了Harris角点检测算法,通过计算像素局部自相关矩阵来识别图像角点。其次详细阐述了SIFT特征检测方法,包括其尺度不变特性、关键点检测和描述符计算过程。最后重点展示了一个基于SIFT的指纹识别系统实现,该系统通过特征提取、FLANN匹配器进行特征比对,并采用Lowe's比率测试筛选优质匹配点,最终根据匹配数量判断认证结果。文中还提供了优化后的指纹识别方案,能够从指纹数据库中识别出对应人员信息,展现了特征检测技术在生物识别领域的实际应用。

2026-03-06 21:23:19 248

原创 计算机视觉进阶教学之图像金字塔和图像直方图

本文介绍了图像金字塔和图像直方图两种重要的图像处理技术。图像金字塔包括向下采样(缩小图像)、向上采样(放大图像)和拉普拉斯金字塔(保留采样丢失信息)。图像直方图部分讲解了彩色图像各通道直方图计算和带掩模的直方图计算方法,以及直方图均衡化技术,包括全局均衡化和自适应局部均衡化(CLAHE)。这些技术广泛应用于图像特征提取、模板匹配、图像增强等领域,通过代码示例展示了OpenCV中相关函数的具体应用。

2026-03-06 20:25:04 258

原创 回归与分类的本质区别

回归分析旨在预测连续的数值型输出。在回归问题中,模型学习输入特征与连续目标变量之间的关系,并能够预测任意实数值。典型示例房价预测:根据房屋面积、位置、房龄等特征预测房屋价格股票价格预测:基于历史数据预测未来股价温度预测:根据气象数据预测未来温度值。

2026-02-19 11:02:39 929

原创 深度学习之模型的部署、web框架 服务端及客户端案例

本文介绍了深度学习模型部署的关键环节与Web框架实现。首先阐述了模型部署的定义、步骤(导出、部署、测试、监控)及常见方式(云端、嵌入式、边缘计算等)。随后对比了三大Python Web框架:Django(功能全面但不够灵活)、Pyramid(高性能但学习曲线陡)、Flask(轻量易学但功能较少)。最后通过Flask实现了一个花朵识别系统的部署案例,包含服务端模型加载、图像预处理和预测接口,以及客户端请求处理流程。该案例展示了如何将训练好的ResNet模型转化为可调用的Web服务,为实际应用提供推理能力。

2026-02-17 18:55:26 1010

原创 自然语言处理项目之情感分析(下)-----模型搭建和训练

摘要:本文介绍了一个基于LSTM的微博评论情感分析项目。项目通过腾讯预训练词向量将文本转换为200维词向量,使用固定长度32处理评论内容,不足则填充,超出则截断。模型采用双向LSTM结构,包含3层隐藏层和dropout正则化。代码实现分为模型定义、训练评估和主函数三个模块,最终在测试集上评估模型性能。项目完整实现了从数据处理到模型训练测试的全流程,为文本情感分析提供了实用解决方案。

2026-02-11 21:50:59 806

原创 自然语言处理项目之情感分析(上)-----数据预处理

本文介绍了一个基于微博评论的情感分析项目。项目通过自然语言处理技术对评论进行情感分类,主要步骤包括:1) 建立4760个高频词的词表,处理未知词和填充;2) 将评论统一为70个字的固定长度,超长截断、不足填充;3) 数据预处理后按8:1:1划分训练集、验证集和测试集;4) 使用DatasetIterater类实现数据批量化处理,自动转换为PyTorch张量格式。该项目为后续模型训练提供了规范化的数据输入格式,实现了从原始文本到模型可处理格式的完整转换流程。

2026-02-11 20:13:59 1050

原创 长短期记忆网络 LSTM 详解

本文介绍了LSTM(长短期记忆网络)的结构、原理及应用。LSTM通过引入记忆单元和遗忘门、输入门、输出门三个门控机制,解决了传统RNN在长序列处理中的梯度消失和信息稀释问题。其核心是细胞状态的稳定传递,能有效保留长期依赖信息。LSTM在自然语言处理(文本生成、机器翻译等)、时间序列预测(股票、天气)和语音识别等任务中表现优异。虽然计算复杂度较高,但其灵活的信息筛选能力使其成为处理长序列数据的重要模型。

2026-02-09 17:54:54 915

原创 循环神经网络RNN与LSTM网络

本文介绍了循环神经网络(RNN)及其改进型LSTM网络。RNN通过引入隐状态处理序列数据,能够记忆之前的信息,但存在梯度消失/爆炸问题,难以学习长期依赖。LSTM通过门控机制(遗忘门、输入门、输出门)有效解决了这一问题:遗忘门决定保留哪些历史信息,输入门更新细胞状态,输出门确定当前隐藏状态。其中tanh和sigmoid函数分别用于信息变换和门控决策。相比传统RNN,LSTM能更好地选择记忆重要信息、遗忘无关内容,从而提升对长序列数据的建模能力。

2026-02-03 11:32:52 802

原创 自然语言处理之第一课语言转换方法

在自然语言处理(NLP)的广阔领域中,语言转换方法是连接不同语言、打破沟通壁垒的关键桥梁,也是初学者开启 NLP 学习之旅的重要入门知识点。无论是日常使用的翻译软件,还是跨语言信息检索、多语言文本分析等专业场景,都离不开高效的语言转换技术。​为了让大家轻松迈入 NLP 语言转换的大门,本博客将以 “第一课” 的视角,用通俗易懂的语言拆解语言转换的核心逻辑。我们会从最基础的规则式转换讲起,带大家了解基于词典和语法规则实现简单语言转换的原理,感受早期技术的朴实思路

2026-01-30 12:18:35 740

原创 Python第三方库之jieba库

在处理中文文本的 Python 第三方库中,jieba 库绝对是不可或缺的 “利器”。它专注于中文分词,能将连续的中文语句精准拆分成有意义的词语,为后续的文本分析、自然语言处理等工作打下坚实基础。无论是新闻数据的关键词提取、社交媒体评论的情感分析,还是聊天机器人的语义理解,jieba 库都能发挥重要作用。对于数据分析师,它能让中文文本数据的处理效率大幅提升;对于自然语言处理爱好者,掌握 jieba 库是深入探索中文语义世界的第一步。

2026-01-30 04:30:57 791

原创 机器学习之词向量转换

本文介绍了自然语言处理中的词向量转换技术及其应用。首先阐述了词向量转换的必要性,即将文本转换为数值向量使计算机能够处理。重点讲解了基于统计的CountVectorizer方法,通过代码示例展示了如何将文本转换为词频矩阵。随后以手机评论情感分析为案例,详细说明了数据处理流程:包括中文分词、去除停用词、构建带标签数据集、拆分训练测试集等步骤。最后演示了如何使用朴素贝叶斯算法进行模型训练和评估,并实现实际预测功能。整个过程展示了从原始文本到情感分类的完整NLP处理流程。

2026-01-29 00:54:25 1376

原创 计算机视觉系列之opencv语法基础案例分析之银行卡号识别

本文介绍了使用OpenCV进行信用卡数字识别的完整流程。首先预处理模板图像,提取0-9的数字模板;然后处理信用卡图像,定位数字区域;接着分割每个数字,并与模板进行匹配识别;最后输出识别结果。文中详细讲解了图像处理的关键步骤,包括灰度转换、二值化、轮廓检测等,并提供了自定义工具函数(轮廓排序、图像缩放)的实现。通过这个小案例,读者可以学习计算机视觉的基础知识,掌握OpenCV在数字识别中的实际应用。

2026-01-27 23:46:24 513

原创 深度学习系列之第八课迁移学习(残差网络ResNet)

本文介绍了迁移学习和残差网络ResNet的基本概念与应用。主要内容包括:1)迁移学习的定义和步骤,通过冻结预训练模型参数并微调新层来适应新任务;2)ResNet网络结构及其残差连接机制,解决了深度网络的梯度消失和退化问题;3)代码实现部分展示了如何加载预训练ResNet-18模型,冻结参数并修改输出层。整体流程从理论到实践,为使用预训练模型提供了清晰指导。

2026-01-27 22:45:37 550

原创 深度学习系列之第七课卷积神经网络_CNN_调整学习率

本文介绍了PyTorch中学习率调整的多种方法,包括有序调整(StepLR、MultiStepLR、ExponentialLR、CosineAnnealing)、自适应调整(ReduceLROnPlateau)和自定义调整(LambdaLR)。同时详细讲解了数据预处理流程,包括图像增强技术(旋转、翻转等)和归一化处理。文章还提供了自定义数据集类的实现代码,展示了如何构建PyTorch数据加载流程。这些技术可以有效优化CNN模型的训练过程,提高模型性能。

2026-01-27 00:50:53 602

原创 深度学习系列之第六课卷积神经网络_CNN_如何保存和使用最优模型

本文介绍了如何保存和使用深度学习训练过程中的最优模型。首先讲解了数据预处理流程,包括图像增强和归一化处理。然后展示了自定义数据集类的实现,包括数据加载和预处理方法。接着描述了CNN模型的结构,包含三个卷积块和一个全连接层。文章重点介绍了训练函数实现,包括前向传播、损失计算、反向传播和参数更新过程。最后提到如何保存训练过程中表现最好的模型,而不是仅保存最后一轮的模型结果。整套流程涵盖了从数据准备到模型训练的关键步骤,为深度学习实践提供了实用参考。

2026-01-26 21:56:14 695

原创 计算机视觉系列第一课opencv语法(四)保姆级教学

本文介绍了OpenCV中轮廓检测与处理的关键技术。主要内容包括:1)轮廓检测API的使用方法,涵盖不同检索模式和近似方法;2)图像预处理(灰度转换、二值化);3)轮廓绘制、面积/周长计算;4)轮廓筛选(按面积)、最大轮廓查找;5)外接圆/矩形绘制;6)轮廓近似方法。文章通过代码示例详细演示了每个步骤的实现过程,适合计算机视觉初学者学习OpenCV轮廓处理技术。

2026-01-25 23:38:38 481

原创 深度学习系列之第五课卷积神经网络_CNN_如何训练自己的数据集(暨食物分类案例)

之前一直使用的是现有人家的数据集,现在我们将使用自己的数据集进行训练。基于卷积神经网络 (CNN) 的 MNIST 手写数字识别模型我们的数据集图片大小不一样我们要进行将图片大小统一,如果数据集图片大小不同意,我们的模型中全链接层就不能确定,导致我们的参数的个数都不能确定下来。data_transforms={ # 字典存储不同的数据转换方式'train':transforms。

2026-01-24 22:58:11 488

原创 基于卷积神经网络_CNN_的MNIST手写数字识别模型

本文介绍了使用PyTorch搭建卷积神经网络(CNN)实现MNIST手写数字识别的完整流程。主要内容包括:导入必要的PyTorch库,加载并预处理MNIST数据集;定义CNN模型结构,包含三个卷积块和全连接层;实现训练和测试函数,使用交叉熵损失函数和优化器;最后执行训练并评估模型性能。该CNN模型通过卷积、池化等操作提取图像特征,在MNIST数据集上实现了较高的识别准确率。整个过程展示了深度学习项目从数据准备到模型训练的标准流程。

2026-01-24 19:07:41 552

原创 深度学习系列之第四课卷积神经网络CNN

本文系统介绍了卷积神经网络(CNN)的核心架构和工作原理。首先阐述了图像在计算机中的表示方式,分析了CNN面临的画面不变性挑战。重点讲解了CNN三大核心组件:卷积层通过滑动窗口提取局部特征,池化层实现降采样减少计算量,全连接层完成最终分类。详细解释了卷积操作的概念和相关参数,包括卷积核大小、步长和填充值等。通过示意图展示了最大池化的压缩功能,说明了感受野的概念及其重要性。最后概述了CNN的典型结构:输入层→卷积+激活→池化→多层堆叠→全连接输出,并列举了LeNet、AlexNet等经典网络架构。全文结合图示

2026-01-24 18:42:29 629

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除