自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(52)
  • 收藏
  • 关注

原创 Hadoop的详细讲解

Hadoop由HDFS、YARN、MapReduce三大组件构成:HDFS实现分布式存储,通过主从架构管理海量数据块并保障可靠性;YARN负责资源调度,支持多框架共存;MapReduce基于“分而治之”模型,通过Map与Reduce阶段完成并行计算。三者协同工作,实现从数据存储、资源分配到计算处理的全流程自动化,支撑大规模数据处理需求。

2026-09-28 20:48:53 383

原创 基于LSTM网络进行微博情绪识别项目

本项目基于微博情绪数据构建TextRNN模型,实现文本分类。通过train_eval_test.py构建词表并划分训练、验证、测试集;load_dataset.py加载数据并处理为ID序列;model.py定义含预训练词向量的BiLSTM模型;main.py启动训练流程,采用Adam优化器与早停机制;最终在predict.py中加载最佳模型,结合Gradio实现网页预测。整体流程涵盖数据预处理、模型训练、评估与部署,支持四类情绪(喜悦、愤怒、厌恶、低落)识别,准确率高且具备实际应用价值。

2026-09-23 21:13:45 132

原创 OpenCV中利用卷积神经网络来进行人脸识别

该代码使用dlib的预训练CNN人脸检测模型(mmod_human_face_detector.dat)在静态图像中检测人脸,通过OpenCV读取图像并以绿色矩形框标出每个人脸。核心流程包括:加载MMOD架构的CNN模型、读取BGR格式图像、调用模型检测人脸(返回矩形框与置信度)、遍历结果并在图像上绘制绿色边框,最后显示结果图像。无需训练,直接推理,实现高效精准的人脸定位。

2026-09-21 21:27:12 236

原创 OpenCV中的疲劳检测

本项目基于dlib人脸68关键点与眼睛纵横比(EAR)实现实时疲劳检测。通过摄像头捕获视频流,检测人脸并定位眼部关键点,计算EAR值判断眼睑开合状态。当EAR持续低于0.3且连续50帧时,判定为疲劳并弹出“!!!!危险!!!!”警告。结合OpenCV与PIL实现中文显示与眼部轮廓绘制,整体流程包括人脸检测、关键点提取、EAR计算、疲劳判断及可视化,有效提升驾驶或监控场景下的安全预警能力。

2026-09-21 20:36:39 216

原创 OpenCV中的表情识别

本项目基于dlib 68点人脸关键点,实现简单表情识别。通过提取嘴部、脸颊、下巴等区域特征,计算MAR(嘴部宽高比)、MJR(嘴宽/脸宽比)、MDR(嘴角下垂比)三个几何特征,结合阈值判断大笑、哭泣、微笑与正常表情。利用OpenCV读取视频、绘制凸包并用PIL支持中文显示。代码结构清晰,适合学习关键点检测与基础表情分类,但实际应用需优化阈值与鲁棒性。

2026-09-20 20:34:14 129

原创 解决梯度消失或者梯度爆炸的方法——残差网络

残差网络(ResNet)由何凯明等人提出,旨在解决深层卷积神经网络中的退化问题与梯度消失/爆炸难题。其核心思想是引入“捷径连接”(shortcut),使输入直接跨层传递,形成F(x)+x的残差结构,有效缓解训练困难。通过使用Batch Normalization稳定特征分布,并结合1×1卷积调整维度,ResNet可实现18至152层的深度网络,显著提升图像分类、目标检测与分割性能,在ImageNet和COCO等竞赛中取得优异成绩。

2026-09-18 20:52:50 170

原创 PyTorch的CBOW词向量模型

本文基于PyTorch实现了一个CBOW词向量模型,通过上下文词预测中心词,训练后提取Embedding层权重作为词向量。核心流程包括语料处理、构建训练样本、上下文索引转换、模型定义(嵌入层+投影层+输出层)及训练优化。使用Adam优化器与NLLLoss进行200轮训练,最终获取10维词向量,并在测试中验证预测效果。

2026-09-17 21:28:24 189

原创 深度学习中迁移学习实践

本脚本基于PyTorch实现迁移学习图像分类,使用ImageNet预训练的ResNet18对20类食物图片进行分类。通过自定义Dataset读取路径与标签,结合数据增强(旋转、翻转、颜色抖动等)提升泛化性,冻结卷积层仅训练替换后的全连接层,采用Adam优化器与学习率衰减策略,每轮评估并保存最优模型。实验表明,该方法训练高效、抗过拟合,验证准确率可达较高水平,充分体现了迁移学习在小样本图像分类中的优势。

2026-09-16 21:24:51 220

原创 深度学习中的迁移学习

迁移学习通过复用预训练模型加速训练并提升性能,尤其在数据稀缺时有效。传统深层网络面临梯度消失/爆炸与退化问题,ResNet通过残差连接实现恒等映射,缓解梯度问题并防止性能下降。结合BatchNormalization稳定输入分布、加速训练并增强泛化。迁移学习步骤包括:选择预训练模型、冻结部分参数、训练新增层、微调特定层,并评估优化效果。

2026-09-16 10:54:29 226

原创 深度学习中的调整学习率

本文系统讲解神经网络训练中学习率的重要性及其调整策略,包括固定学习率的局限性与动态调整的必要性。介绍了StepLR和ReduceLROnPlateau两种常用调度方法,前者按周期衰减,后者基于验证指标自适应调整。结合完整代码实现,涵盖数据集构建、图像增强、自定义Dataset、CNN模型设计及验证流程,全面展示从数据处理到模型训练的全流程,助力高效、稳定地训练深度学习模型。

2026-09-15 21:29:21 150

原创 深度学习中食物图像分类项目讲解

该代码实现20类食物图像分类闭环流程:通过train_test_file()生成标签索引,确保训练与测试标签一致;数据增强包括随机旋转、翻转、色彩调整及灰度转换,提升模型鲁棒性;自定义Dataset读取路径与标签,统一转为三通道RGB并标准化;CNN模型采用三层卷积+池化结构,最终展平分类;使用CrossEntropyLoss与Adam优化器训练,保存最优模型,并支持灰度图测试。

2026-09-15 19:39:52 122

原创 计算机视觉OpenCV中的FisherFace人脸识别

本文实现了一个基于OpenCV的FisherFace人脸识别小示例。通过读取灰度人脸图像并统一尺寸,利用FisherFace(结合PCA与LDA)训练模型,对未知人脸进行识别。采用PIL绘制中文结果,解决OpenCV不支持中文显示问题。实验中成功将待识别人脸识别为“黎明”,并设置置信度阈值5000以判断识别可靠性,展示了FisherFace在分类任务中的有效性。

2026-09-14 19:54:11 144

原创 OpenCV中基于dlib的人脸检测

读取图片——>创建dlib正面人脸检测器——>detector(img,1)检测人脸——>遍历每个人脸矩形框——>获取left/top/right/bottom坐标——>cv2.rectangle画绿色矩形——>cv2.imshow()显示结果——>cv2.waitKey等待按键——>cv2.destoryAllWindows关闭窗口。

2026-09-13 21:23:32 174

原创 Linux常见的基础命令

ls:列出当前目录文件。ls /etc:查看指定目录。cd /etc:进入 /etccd .. :返回上一级cd ~:回到用户主目录pwd:显示当前路径。mkdir + 目录名:创建目录mkdir -p +a/b/c :递归创建多级目录rmdir + 目录名:删除空目录touch + 文件名:创建空文件cp + 源 + 目标:复制源文件或者源目录到目标位置。mv + 源 + 目标:移动源文件或者源目录到目标位置,把源文件或源目录改名到目标名称rm + 文件:删除文件。

2026-09-11 20:53:11 67

原创 OpenCV中的LBPH人脸识别

本文介绍使用OpenCV的LBPH算法实现人脸识别的Python代码。流程包括灰度读取图像(无需缩放)、标签定义、创建默认参数的LBPH识别器(半径1,邻域8,网格8×8),训练后预测身份与置信度。LBPH基于局部二值模式直方图,通过统计图像分块LBP直方图特征,对光照变化鲁棒,计算高效,不强制图像尺寸统一。相比EigenFace,LBPH更适应非标准化输入,但需注意噪声影响。

2026-09-09 21:05:53 114

原创 OpenCV中利用EigenFace算法进行人脸识别

本实验基于EigenFace算法,使用4张人脸图像(黎明2张、安志杰2张)训练识别器,通过OpenCV实现灰度化、尺寸统一、PCA降维及特征脸提取。利用cv2.face.EigenFaceRecognizer_create()进行训练与预测,对测试图像输出身份标签与置信度,并在图像上标注结果。核心原理为将人脸投影至低维特征脸空间,通过欧式距离匹配识别。实验完整演示了人脸识别流程,有助于理解PCA降维与分类机制,但需优化阈值与数据量以提升实用性。

2026-09-09 19:47:56 166

原创 OpenCV中的微笑检测

本次学习的是一个典型的OpenCV级联分类器应用示例,能够实现基础的实时微笑检测。它展示了:1.级联分类器的加载与使用。2.多尺度目标检测的参数调优。3.ROI截取与坐标交换。4.视频流处理与显示。

2026-09-09 15:49:51 226

原创 OpenCV中的人脸检测

<think>我们根据内容生成摘要。用户要求根据内容生成≤150字的文章摘要。需要提取关键点:使用OpenCV Haar级联分类器进行人脸检测,原理、代码、步骤,画绿框,输出数量/位置。需要简洁。</think>本文介绍使用OpenCV Haar级联分类器对静态图片进行人脸检测:通过Haar-like特征与AdaBoost级联分类器,以积分图加速滑动窗口扫描;代码依次完成灰度转换、加载预训练模型、调用detectMultiScale检测,并在原图上绘制绿色矩形框,最后输出人脸数量和位

2026-09-06 20:42:47 184

原创 2个输入通道、2个滤波器的卷积例子

滤波器1(w0):用于生成输出通道0。包含2个通道的2*2矩阵,偏置b0=1。滤波器1(w1):用于生成输出通道1,包含2个通道的2*2矩阵,偏置b1=0。输出尺寸=[(输入尺寸-卷积核大小+2*填充)/步长]+1=3-2+1=2,所以输出2*2*2(最后一个2代表滤波器个数)。

2026-09-04 21:14:21 230

原创 卷积神经网络

<think>我们只需要根据用户要求,生成≤150字的文章摘要。摘要内容要概括主要观点:为什么需要CNN、四大核心操作、CNN特征金字塔。注意字数。直接输出摘要即可。</think>本文介绍了卷积神经网络(CNN)的核心概念。CNN通过局部连接与参数共享解决全连接网络参数爆炸和难以学习局部相关性的问题。其四大操作包括:卷积层提取特征、激活函数非线性化、池化层降采样增强平移鲁棒性、全连接层分类。CNN层层堆叠形成从边缘到部件再到整体的特征金字塔,最终实现图像识别。

2026-09-03 21:01:06 243

原创 OpenCV中利用DNN模块实现风格迁移

<think>我们只需要根据内容生成一个≤150字的摘要。内容是关于使用OpenCV DNN实现图像风格迁移的步骤和总结。摘要要简洁,涵盖主要点。</think>本文介绍了利用OpenCV DNN模块实现图像风格迁移的完整流程,包括图像读取、blob预处理、加载模型、前向传播及后处理(重塑、归一化、转置),展示了深度学习标准流水线,体现了DNN模块的便捷性与强大功能。

2026-09-02 20:40:46 327

原创 OpenCV中稀疏光流的特征点轨迹跟踪

<think>我们根据要求生成摘要,不超过150字。内容是关于Lucas-Kanade金字塔光流代码的讲解。需要概括核心:稀疏光流、LK假设、金字塔作用、代码流程。简洁。</think>本文讲解基于OpenCV的Lucas-Kanade金字塔光流实现:在视频首帧提取100个强角点,利用亮度恒定、小运动、空间一致性假设,通过图像金字塔追踪快速运动点,并绘制彩色轨迹,完整展示了从角点检测到光流跟踪、过滤与渲染的流程。

2026-09-02 19:36:19 248

原创 OpenCV中运动目标检测

它在保留物体形状的同时,对于对角线方向的噪声抑制效果较好。MORPH_OPEN为开运算:先腐蚀后膨胀,先消除白色区域边缘的细小噪声,让物体的边界向内收缩;再将腐蚀后剩余的物体轮廓涨回来,恢复原本的大小,同时填补物体内部细小的黑洞。它能自适应光照变化。其中白色(255)为运动的物体,黑色(0)为背景,灰色被算法判定为阴影。这次的实践浓缩了视频处理的完整操作:数据采集->背景建模->形态学过滤->特征提取->逻辑过滤->结果可视化。此时的fgmask会有很多细小的白色噪点,甚至会有空洞,直接拿去用效果很差。

2026-08-30 20:58:56 228

原创 深度学习-手写数字识别

代码逻辑非常清晰,完全按照深度学习的标准流程走:数据加载 -> 定义模型 -> 训练 -> 测试。首先导入代码所用到的相关模块代码root="data"是数据存放路径;train=True是加载训练集;transform=ToTensor()是将图片转换为pytorch能够处理的张量,并进行归一化。这是一种三层全连接神经网络(MLP):nn.Flatten()(展平层):MNIST 的原始图片是一个二维的 28×28 的像素矩阵。但全连接神经网络不认识二维数组,它只认一维的向量。所以第一件事就是把这 784

2026-08-29 14:03:10 327

原创 OpenCV计算机视觉实战:答题卡识别

在计算机视觉的入门与进阶过程中,OpenCV 是绕不开的强大工具。结合实战项目系统性地展示如何利用 OpenCV 完成图像预处理、特征提取、透视变换、轮廓检测、特征匹配等经典任务。

2026-08-27 21:10:27 203

原创 深度学习入门

深度学习是机器学习领域中一个新的研究方向。深度学习是一种人工智能的子领域,它基于人工神经网络的概念和结构,通过模拟人脑的工作方式来进行机器学习。深度学习 的主要特点是使用多层次的神经网络来提取和学习数据中的特征,并通过反向传播算法来优化网络参数,从而实现对复制数据的建模与分类。深度学习在图像识别、语言识别、自然语言处理等领域取得了显著的成果,并被广泛应用于各种领域。神经网络是一种由多个神经元(或称为节点)组成的计算模型,它模拟了生物神经系统中神经元之间的连接方式。

2026-08-26 19:49:41 195

原创 基于OpenCV的特征点检测与指纹识别系统实践

角点就是图像中的点,比如棋盘格拐角、窗户角。OpenCV 的gray是经过转换后的。邻域窗口的大小,这里是4x4像素。Sobel 梯度算子的孔径大小,这里是3*3。

2026-08-25 20:32:36 243

原创 机器学习中经典算法的归纳

无监督学习就是“没有标准答案的自主探索”。训练数据里只有“问题”(特征X),没有任何标签(Y)。机器根本不知道这些数据是什么,只能自己去发现数据内部隐藏的结构和规律。无监督学习的典型任务:聚类。聚类,就是在没有任何标准答案(没有标签)的情况下,让机器根据数据之间的“相似度”,自动把相似的东西归成一个个“小团体”(即簇)。二、7大算法的归类看离你最近的K个邻居是啥样,分类时投票,回归时取平均。有监督。主要用途是用于分类和回归。(2)线性回归:画一条直线(或超平面)来拟合数据,预测连续数值,比如房价。

2026-08-24 19:46:50 186

原创 基于OpenCV的计算机视觉综合实战项目

从一张倾斜拍摄的纸质发票照片开始,通过一系列图像处理手段,将其矫正、二值化与去噪,最终为OCR(文字识别)或信息录入做准备。

2026-08-23 20:40:53 193

原创 Mysql的高级查询

SELECT 分组函数(列),分组列FORM 表名WHERE 分组前筛选GROPUP BY 分组列HAVING 分组后筛选ORDER BY 排序;优先使用WHERE(性能更好),能用分组前筛选的就不要用HAVING。

2026-08-21 20:38:26 209

原创 Mysql的查询语句

DQL用于从数据库中检索数据,最基础的语法结构如下:SELECT 查询列表FROM 表名WHERE 筛选条件ORDER BY 排序列表;其中执行的顺序是FROM——>WHERE——>SELECT——>ORDER BY。其中在Mysql中,sql关键字像SELECT、FROM、WHERE、ORDER BY等不区分大小写。

2026-08-20 21:09:35 203

原创 Linux系统的基础知识及相关操作

Linux系统以"一切皆文件"为核心设计理念,所有资源都抽象为文件,可通过统一系统调用操作。Vim编辑器具有三种工作模式:一般模式(光标移动/文本操作)、编辑模式(内容输入)和命令模式(保存/搜索等高级命令)。常用基础命令包括pwd(显示路径)、cd(切换目录)、ls(查看文件)、mkdir/rmdir(目录管理)、rm(删除)、cp(复制)等。系统服务管理通过systemctl命令实现,支持启动(start)、停止(stop)、重启(restart)和查看状态(status)等操作。这

2026-08-20 20:02:00 181

原创 OpenCV实战:基于模板匹配的银行卡号识别

本文介绍了基于OpenCV和Python的银行卡号识别系统实现方案。系统采用模板匹配方法,主要包含数字字典构建、图像预处理、数字定位和模板匹配四个步骤。通过顶帽操作突出数字、闭操作连接断裂数字,并结合轮廓分析定位卡号区域。系统具有处理速度快(毫秒级)、无需训练数据的优点,但对图像质量和字体一致性要求较高,存在倾斜或字体差异时识别率会下降。该方案特别适用于字体规范、排列规则的银行卡识别场景。

2026-08-19 16:39:44 187

原创 机器学习中的K-means算法

本文介绍了K-means聚类算法的原理与应用。K-means通过迭代优化将数据划分为K个簇,以最小化簇内误差平方和。实践案例演示了啤酒数据的聚类流程:数据预处理后标准化特征,使用肘部法则确定最佳K值(K=3),最终实现基于多维特征的自动分组。该案例展示了K-means如何通过质心反映不同簇的特征差异,为无监督学习提供了实用示例。

2026-08-12 20:04:29 239

原创 自然语言处理实践

本文介绍了中文文本分类项目的完整流程:1) 使用pandas读取结构化评论数据;2) 通过jieba进行中文分词并过滤无效文本;3) 移除停用词清洗数据;4) 构建带标签的数据集并随机划分训练/测试集;5) 使用CountVectorizer进行文本向量化,考虑1-3gram特征;6) 采用多项式朴素贝叶斯模型训练,并评估分类效果。重点解决了数据分布不均问题,通过打乱数据和设置随机种子保证模型能学习到全部类别特征。

2026-08-12 11:13:05 231

原创 自然语言处理基础

本文介绍了中文自然语言处理(NLP)的三个关键技术:分词、停用词过滤和TF-IDF特征提取。以《红楼梦》文本处理为例,展示了如何使用jieba分词工具结合自定义词典处理专业词汇,通过停用词表过滤无效词语,最后利用TF-IDF算法从文本中提取关键特征。文章着重说明了自定义词典的最长匹配原则,以及TF-IDF通过词频和逆文档频率计算词语重要性的原理,为中文文本分析提供了实用方法指南。

2026-08-10 20:10:47 194

原创 用OpenCV实现“找形状、识图标、盯物体“

本文介绍了OpenCV中三种图像处理技术:轮廓检测、模板匹配和实时目标跟踪。轮廓检测通过二值化提取目标轮廓,计算面积、周长等几何特征,并提供压缩存储模式;模板匹配采用滑动窗口原理,推荐使用归一化方法提升稳定性;实时跟踪利用CSRT算法锁定移动目标,支持交互式ROI选择。三种技术分别适用于静态特征提取、图像定位和动态追踪场景,文中还提供了关键参数设置和优化建议。

2026-08-07 20:28:58 178

原创 SVM支持向量机

SVM(支持向量机)是一种监督式机器学习算法,核心思想是通过寻找最优超平面实现分类,并最大化间隔以增强泛化能力。其三大核心模块包括:硬间隔处理线性可分数据、软间隔允许噪声容忍、核技巧解决非线性问题。SVM擅长高维小样本数据,具有强泛化能力和抗干扰性,但训练速度较慢且调参复杂。总体而言,SVM在中等规模、高维数据场景中表现优异,是经典且实用的分类算法。

2026-08-06 20:58:28 332

原创 机器学习中的朴素贝叶斯

代码为MultinomialNB(alpha=1).fit(X_train, y_train),作用为让模型“吃透”训练数据,计算出朴素贝叶斯公式所需的所有关键概率参数,生成一个训练好的分类器对象。代码为train_test_split(test_size=0.2, random_state=100),作用为80%训练,20%测试,固定随机种子保证可复现。代码为classifier.score(X_test, y_test),作用为直接输出模型在测试集上的整体精度。P(y):类别为y的概率。

2026-08-05 20:14:01 236

原创 计算机视觉OpenCV中的图像处理

本文介绍了图像处理中的形态学操作和边缘检测技术。形态学操作包括腐蚀、膨胀、开运算、闭运算等7种基本操作,用于处理二值或灰度图像,可消除噪声、连接断裂等。边缘检测部分讲解了Sobel、Scharr、Laplacian算子和Canny算法,重点说明Canny检测的高斯滤波、梯度计算、非极大值抑制和双阈值处理四个步骤,以及不同算子的特点和应用场景。这些方法是计算机视觉中基础而重要的特征提取技术。

2026-08-04 20:51:28 248

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除