- 博客(79)
- 收藏
- 关注
原创 基于Qt和PaddleOCR的工业视觉识别报警系统开发
本文介绍了一个基于PyQt5、PaddleOCR和海康工业相机的多路视觉识别报警系统。系统可同时监控三个摄像头,利用PaddleOCR(GPU加速)识别产品型号,并通过串口控制声光报警器。关键技术包括:工业相机初始化配置、多线程视频采集、OCR字符识别优化(含易错字符替换和区域面积筛选)、报警逻辑实现以及定时资源释放机制。系统采用PyQt5构建三路视频并排显示的GUI界面,通过降低OCR调用频率和GPU加速实现性能优化。该方案已在工业环境中稳定运行,满足生产线实时监控需求,为工业视觉系统开发提供了实用参考。
2026-04-12 22:52:40
890
原创 PyQt5 + PaddleOCR实战:打造桌面级实时文字识别工具
本文介绍了一个基于Python的实时文字识别工具开发方案。该项目整合PyQt5、PaddleOCR和OpenCV技术,实现桌面级实时文字识别功能。系统通过摄像头捕捉画面,实时识别并显示文字内容,具有以下特点:1) 简洁的GUI界面设计;2) 支持中英文混合识别;3) 可配置CPU/GPU加速;4) 实时显示识别结果和置信度。文章详细讲解了环境配置、界面设计、核心代码实现及常见问题解决方案,为开发者提供了一个完整的OCR应用开发框架,可扩展用于文档扫描、翻译辅助等多种场景。
2026-04-06 20:55:20
1170
原创 大模型--Llama_factory的使用(上)
本文介绍了LLaMA-Factory工具的使用流程,主要包括三个核心步骤:1)使用LoRA方法微调Qwen3-4B-Instruct模型;2)通过命令行交互测试模型效果;3)合并LoRA权重生成完整模型文件。文章详细解析了每个阶段对应的YAML配置文件关键参数,包括训练参数设置、推理引擎选择和模型合并注意事项。同时介绍了safetensors安全张量格式的优势,以及huggingface、vLLM等不同推理后端的特点和适用场景。
2026-03-31 18:53:50
1059
原创 大模型--模型部署
本文介绍了机器学习模型部署的基本概念和实际应用。模型部署是将训练好的模型集成到生产环境,使其能够接收输入数据并实时输出预测结果的过程。文章详细说明了部署的必要性、常见方式(Web API、嵌入式、批处理等)及关键考量因素(性能、并发、安全等)。通过一个图像分类服务的实现示例,展示了使用Flask框架搭建REST API服务器端和客户端调用的完整流程,包括模型加载、图像预处理、预测路由处理等核心代码。最后指出了实际应用中需要注意的模型路径、类别映射、错误处理等问题,为模型部署实践提供了实用指导。
2026-03-29 21:17:18
1074
原创 汽车零件分装报警系统:从0到1搭建工业级标签识别与预警平台
本文介绍了一套基于机器视觉的汽车零件标签自动识别报警系统。系统采用三层架构:工业相机采集层(海康威视)、OCR识别层(PaddleOCR)和PyQt5应用层,实现了30fps实时检测。针对工业场景中的字符误识别问题,开发了字符替换映射和正则过滤算法,使识别准确率提升至90%以上。系统还集成了串口控制的声光报警功能,当检测到标签错误时立即触发报警。通过多线程优化和资源释放机制,确保了系统7×24小时稳定运行。实际应用表明,该系统有效降低了30%的返工率,为工业质检自动化提供了可靠解决方案。
2026-03-25 17:06:08
1011
原创 大模型--OpenAI&创建阿里云百炼API Key
摘要:本文介绍了OpenAI大模型的发展历程、核心技术及应用场景。OpenAI基于Transformer架构,通过自监督预训练和强化学习优化模型性能,已从GPT-1发展到GPT-5系列。这些模型可应用于智能客服、编程辅助、内容创作等多个领域。同时,文章提供了调用阿里云通义千问API的Python代码示例,包括API密钥获取、客户端创建及对话补全的实现步骤,展示了如何兼容OpenAI方式使用国内大模型服务。
2026-03-24 20:40:27
1326
原创 opencv计算机视觉--PaddleOCR的实时多语言文本检测与识别
OCR(光学字符识别)技术通过计算机视觉和机器学习算法,将图像中的文字转换为可编辑文本。其处理流程包括图像预处理、文字检测、识别和后处理四个阶段。本文详细介绍了基于PaddleOCR的实现方法,涵盖静态图片和实时视频中的中英文识别,特别针对中文显示问题提供了PIL库的解决方案。同时给出了性能优化建议(GPU加速、跳帧处理等)和常见问题解决方法,并探讨了多语言识别、结果保存等扩展应用场景。通过这套方案可构建完整的实时OCR识别系统,满足不同场景下的文字识别需求。
2026-03-18 16:46:05
1187
原创 大模型框架--初识LangChain
摘要: LangChain是一个大模型应用开发框架,将AI应用开发中的常见需求(如记忆、工具调用、知识库检索等)封装为标准化组件。其五大核心功能包括: 模型输入输出:统一接口适配不同大模型; 链:串联多步骤工作流; 记忆:实现多轮对话上下文管理; 智能体:支持自主决策与工具调用; 检索增强生成(RAG):结合外部知识库提升回答准确性。 LangChain还提供生态工具(如LangServe部署、LangSmith调试),解决重复开发、模型切换等痛点,适用于企业、开发者快速构建复杂AI应用。
2026-03-17 15:13:54
380
原创 深度学习--自然语言学习bert框架
摘要:BERT是基于Transformer的双向预训练语言模型,通过遮蔽语言模型和下一句预测任务学习语言特征,在多项NLP任务中表现优异。相比传统RNN和Word2vec,BERT采用自注意力机制和多头结构,支持并行计算并解决一词多义问题。Transformer架构包含编码解码框架、位置编码等技术,通过多层堆叠提取深度语义。实际应用中可从GitHub获取模型,需TensorFlow1.x环境支持,通过微调适配下游任务,使用时需注意参数设置和路径规范。BERT推动了预训练模型发展,为后续模型奠定基础。
2026-03-16 19:16:41
504
原创 深度学习--循环神经网络原理&局限&与LSTM解决方案
本文系统介绍了循环神经网络(RNN)及其改进版LSTM的核心原理与应用。首先分析了传统神经网络在处理序列数据时的局限性,进而阐释RNN通过隐状态机制实现时序记忆的特性。重点探讨了RNN面临的长期依赖问题及其根源,详细解析了LSTM通过遗忘门、输入门和输出门组成的门控机制,有效解决梯度消失问题的创新设计。最后对比了RNN和LSTM在不同长度序列任务中的应用选择,指出LSTM因其优异的长程记忆能力,已成为处理复杂序列任务的主流模型。全文深入浅出,为理解RNN和LSTM提供了清晰的入门指南。
2026-03-13 19:28:38
553
原创 YOLOv4--目标检测领域的技术融合与性能突破
YOLOv4通过模块化整合目标检测领域先进技术,实现了精度与速度的平衡。其核心技术包括:1)数据增强方面采用马赛克拼接、自对抗训练等方法;2)损失函数优化为CIOU损失,提升定位精度;3)改进NMS算法减少漏检;4)网络结构采用CSPDarknet53骨干网络和SPP+PAN特征融合。实验表明,YOLOv4在COCO数据集上mAP50达82.3%,同时保持65FPS的实时检测速度,成为工业应用与学术研究的经典模型。这种系统性技术整合思路为后续目标检测算法发展提供了重要参考。
2026-03-12 19:03:55
668
原创 大模型推理--transformers&模型下载&实际运用
摘要:本文介绍了HuggingFace的transformers和diffusers库的区别,重点演示了使用transformers库实现电影评价分类任务的全过程。首先介绍了Qwen2.5-1.5B-Instruct模型的三种下载方法,然后详细解析了代码实现步骤:从模型加载、任务模板定义、文本编码、模型推理到结果解码。特别说明了如何通过提示工程和强制输出限定来获得"正面/负面/中立"的分类结果。整个过程展示了如何利用预训练大模型完成特定NLP任务,为开发者提供了实用的技术参考。
2026-03-11 20:41:41
1069
原创 GitHub--仓库创建与基本代码提交&Git分支
本文介绍了Git仓库的创建、基本代码提交与分支管理。主要内容包括:1)从本地项目初始化Git仓库到首次提交的完整流程;2)如何创建GitHub远程仓库并关联本地仓库;3)基本的代码修改、提交和推送操作。在分支管理部分,详细讲解了分支的概念与作用,包括主分支、功能分支和修复分支的使用场景,以及GitHub Flow的分支策略。文章通过论文写作的类比,形象说明了分支隔离开发的价值,并提供了常见分支类型及其命名规范。
2026-03-08 21:37:20
441
原创 GitHub的使用
GitHub是一个基于Git的代码托管和协作开发平台,提供代码托管、版本管理、团队协作等功能。它与Git的关系是:Git是本地版本控制工具,GitHub则是基于Git的云端协作平台。注册GitHub账号后,需配置SSH密钥以提高安全性并简化操作流程。具体步骤包括生成SSH密钥、添加公钥到GitHub账户,并通过命令验证配置是否成功。GitHub在软件开发中具有代码备份、团队协作、开源共享等价值。
2026-03-08 17:20:22
659
原创 数据集打标签--labelme的使用
摘要:本文介绍了常用的图像标注工具(LabelImg、Labelme、VIA等),重点讲解Labelme的安装与使用。安装时需依次执行pip安装命令,若报错可通过修改代码或指定版本解决。使用流程包括:导入图片→创建标注框(支持多种形状)→命名标签→保存为JSON文件。JSON文件包含版本、标签名、坐标、图片尺寸等信息。Labelme支持多种标注类型,保存文件为字典结构的JSON格式,记录了标注的详细数据。
2026-03-06 19:50:49
828
原创 PyQt5保姆级教程--入门
本文介绍了PyQt5开发环境的搭建与基本使用流程。主要内容包括:1)通过pip安装PyQt5和Qt工具包;2)在PyCharm中配置QtDesigner和PyUIC工具;3)使用QtDesigner设计图形界面,包括常用控件的功能说明;4)将.ui文件转换为.py文件;5)创建主程序框架加载UI界面。文章详细说明了开发工具配置的具体步骤,并提供了示例代码模板,帮助开发者快速上手PyQt5图形界面开发。需要注意的是,该示例仅实现了界面显示功能,具体的控件功能实现需要开发者自行编写相关代码。
2026-03-04 17:34:36
1093
原创 YOLOv3目标检测模型
YOLO-v3目标检测模型改进与核心机制 摘要:YOLO-v3在保持高mAP的同时显著提升了执行速度。其主要改进包括:1)采用9个先验框(比v2增加4个)并针对13×13、26×26、52×52三种尺度特征图分别分配大、中、小锚框;2)引入残差连接解决梯度问题并提升特征复用;3)全卷积网络设计,通过stride=2实现下采样;4)使用独立Logistic分类器替代Softmax,支持多标签分类。这些改进使YOLO-v3更适合小目标检测,并融合了当时主流深度学习技术。
2026-03-04 15:01:56
692
原创 YOLO--YOLOV1目标检测模型
YOLOv1是首个单阶段目标检测算法,将图像划分为7×7网格,每个网格预测2个边界框及其置信度和20类概率。采用24层卷积网络和端到端设计,损失函数综合位置、置信度和分类误差。通过非极大值抑制(NMS)消除冗余检测框,保留最高置信度结果。其优势在于速度快、架构简单,但存在小目标检测效果差、网格单类别预测限制等不足。尽管存在局限,YOLOv1开创性的设计思想对目标检测领域发展产生深远影响。
2026-03-02 19:21:20
2049
原创 YOLO--YOLOv2目标检测模型
YOLOv2作为目标检测领域的里程碑式算法,在YOLOv1基础上进行了十大核心改进:引入Batch Normalization、高分辨率预训练、DarkNet-19骨干网络、K-Means聚类生成先验框、直接位置预测、细粒度特征融合和多尺度训练等。这些优化使mAP从63.4%提升至76.8%,同时保持40+FPS的实时检测速度,并实现9000+类目标识别。YOLOv2通过平衡速度与精度,在视频监控、自动驾驶等领域展现出显著优势,其核心思想为后续YOLO系列算法奠定了基础
2026-03-02 19:08:44
640
原创 深度学习--卷积神经网络之迁移学习&ResNet
摘要:本文介绍了迁移学习技术及其在食物分类任务中的应用。通过预训练ResNet18模型,采用冻结卷积层参数、替换全连接层的方法,实现20类食物图像分类。详细解析了数据预处理、模型构建、训练流程等关键步骤,包括数据增强、ImageNet标准化、自适应设备选择等技术要点。案例展示了迁移学习在小样本场景下的优势,完整代码实现了从数据加载到模型训练评估的全流程。文章还简要介绍了ResNet网络的残差结构及其解决梯度消失/爆炸问题的原理,为深度学习实践提供了实用参考。
2026-02-27 15:35:21
978
原创 深度学习--卷积神经网络之调整学习率
摘要:本文介绍了神经网络训练中学习率调整的方法。学习率决定了权重更新速度,通常初期采用较大值加速收敛,后期减小以优化结果。PyTorch提供了多种调整策略:1)有序调整包括等间隔(StepLR)、多间隔(MultiStepLR)、指数衰减(ExponentialLR)和余弦退火(CosineAnnealingLR);2)自适应调整(ReduceLROnPlateau)根据指标变化动态调整;3)自定义调整(LambdaLR)允许按需设置不同层的学习率。
2026-02-27 15:07:22
625
原创 opencv计算机视觉--模板匹配&物体跟踪
本文介绍了OpenCV中的模板匹配和物体跟踪技术。模板匹配使用cv2.matchTemplate()函数,提供多种匹配方法(如平方差、相关匹配等),通过比较模板图像与目标图像找到最佳匹配位置。物体跟踪则通过创建跟踪器(如CSRT、KCF等)、选择目标区域、初始化并更新跟踪器来实现连续帧中的目标追踪。文章给出了完整的代码示例,包括图像预处理、匹配结果显示和实时摄像头跟踪的实现流程。这两种技术可广泛应用于目标检测、视频监控等计算机视觉任务。
2026-02-09 20:44:26
1669
原创 opencv计算机视觉--LBPH&EigenFace&FisherFace人脸识别
本文系统介绍了三种经典人脸识别算法:LBPH、EigenFace和FisherFace。LBPH基于局部二值模式,具有光照不变性和计算简单的优点;EigenFace采用PCA降维,原理清晰但受光照影响较大;FisherFace利用LDA进行有监督分类,判别性强但易受小样本限制。文章详细阐述了各算法的数学原理、OpenCV实现方法(包括关键参数设置和函数使用),并通过实验对比了它们的优缺点和适用场景。最后提出了算法选择建议:光照变化大选LBPH,样本充足选FisherFace,样本少选EigenFace
2026-02-08 21:04:08
1908
原创 深度学习--卷积神经网络(下)
本文介绍了一个基于卷积神经网络的食物图像分类系统实现过程。主要内容包括:1)数据预处理,通过Python脚本生成训练集和测试集路径文件;2)数据增强策略,采用旋转、裁剪、翻转等9种图像变换方法提升模型泛化能力;3)构建三层CNN网络结构,包含卷积、ReLU激活和池化操作;4)训练流程设计,使用交叉熵损失和Adam优化器进行10轮训练;5)模型保存机制,支持参数状态和完整模型两种保存方式。系统通过PyTorch框架实现,能自动选择GPU/CPU设备,最终输出模型在测试集上的准确率和损失值。
2026-02-04 15:57:58
1364
原创 深度学习--卷积神经网络(上)
本文系统介绍了卷积神经网络(CNN)的工作原理。首先阐述了图像的数值表示方法,包括灰度图和RGB三通道模型。重点讲解了CNN的核心组件:1)卷积层通过卷积核提取特征,涉及步长、填充等参数;2)池化层实现降采样,包括最大池化和平均池化;3)全连接层完成最终分类。文章还分析了CNN的关键特性如图像不变性、感受野等,并对比了LeNet、AlexNet、VGGNet、ResNet等典型CNN模型的结构特点。这些组件和原理共同构成了CNN强大的图像识别能力。
2026-02-03 21:56:24
1823
原创 opencv计算机视觉--DNN模块实现风格迁移
OpenCV DNN模块是用于深度神经网络推理的工具,支持加载TensorFlow、PyTorch等多种框架的预训练模型。核心功能包括图像预处理(blobFromImage)、模型加载(readNet)和前向传播(forward)。模块支持硬件加速,适用于实时计算机视觉任务。典型应用包括图像风格迁移,通过预处理输入、设置网络参数和解析输出结果,可将艺术风格应用于图片或实时视频。还能实现多风格同时处理,如将摄像头画面分割为四个区域分别应用不同滤镜后拼接展示。使用需注意输入尺寸、通道顺序和归一化等预处理要求
2026-02-02 20:18:09
1579
4
原创 Opencv计算机视觉--图像边缘检测
本文介绍了OpenCV中四种常用的边缘检测算子:Sobel、Scharr、Laplacian和Canny。Sobel算子通过一阶导数检测水平和垂直边缘,需将x、y方向结果加权合并;Scharr是Sobel的改进版,对边缘响应更好但只支持3x3核;Laplacian是二阶微分算子,能检测各方向边缘但对噪声敏感;Canny算法通过高斯滤波、梯度计算、非极大值抑制和双阈值检测实现最优边缘检测。文中给出了各算子的Python实现示例,包括图像预处理、边缘检测、结果转换和显示等步骤,并详细说明了各参数的作用。
2026-02-01 20:58:47
1155
原创 Opencv计算机视觉--边界填充&图像形态学
本文介绍了OpenCV中的图像处理技术,主要包括边界填充和形态学操作两部分。在边界填充部分,详细讲解了cv2.copyMakeBorder()函数的使用方法,包括五种边界类型(常量填充、反射、反射101、复制和包裹)的实现与区别。在形态学操作部分,阐述了腐蚀、膨胀、开运算、闭运算等基本操作原理,并介绍了形态学梯度、顶帽和黑帽运算等高级操作的应用场景。通过多个实例演示了这些技术在图像处理中的实际应用,如去除噪声、连接断裂纹路、提取边缘特征等操作。文章还特别强调了参数设置对处理效果的影响
2026-02-01 20:55:01
1267
原创 opencv计算机视觉--光流估计&视频读取方法
本文介绍了光流估计技术及其实现方法。光流通过分析连续帧像素强度变化来估计运动,基于亮度恒定和时空连续性假设。重点讲解了OpenCV中的关键函数:cv2.goodFeaturesToTrack()用于角点检测,cv2.calcOpticalFlowPyrLK()实现金字塔Lucas-Kanade光流算法。文章详细解析了算法流程、参数设置及原理,包括图像金字塔构建和窗口搜索机制。通过视频读取与处理的实例代码,展示了特征点检测、光流计算和轨迹绘制的完整过程,并比较了视频与图片处理的差异。
2026-01-31 19:43:31
1513
原创 opencv计算机视觉--答题卡识别案例
本文介绍了一个基于OpenCV的答题卡自动识别与评分系统。系统通过图像预处理、答题卡定位、透视变换、选项检测和答案判断等步骤实现自动化评分。关键技术包括:坐标排序函数确保透视变换准确性,轮廓检测筛选圆形选项,掩膜技术统计涂黑区域判断选择答案。系统能自动矫正倾斜答题卡,计算得分并可视化标记结果。该方案具有鲁棒性强、检测精确的特点,但也存在依赖图像质量、仅支持固定格式等局限性,适用于标准化的单选题自动批改场景。
2026-01-29 19:58:45
1448
原创 opencv计算机视觉--Harris角点检测&SIFT特征提取&图片抠图
本文介绍了计算机视觉中Harris角点检测和SIFT特征提取两种关键技术。Harris角点检测通过分析图像局部窗口的灰度变化来识别角点,输出响应值图并进行阈值处理;SIFT特征提取则包含尺度空间极值检测、关键点精确定位、方向分配和描述符生成四个步骤,输出关键点位置和128维特征向量。文章对比了两种方法的应用场景和核心区别,并提供了实际代码示例。此外还展示了一个图片抠图案例,演示了如何通过轮廓检测和按位与操作实现目标提取。这些技术为图像处理、特征匹配等应用提供了重要工具。
2026-01-28 18:40:45
1303
原创 opencv计算机视觉--图形透视(投影)变换&图形拼接
本文介绍了计算机视觉中的两项核心技术:图形透视变换和图像拼接。在透视变换部分,详细讲解了如何通过四点变换实现文档校正,包括点排序、变换矩阵计算和实际应用流程(发票扫描案例)。图像拼接部分重点解析了cv2.findHomography()函数的使用,包括RANSAC算法原理和参数调优技巧,并展示了完整的图像拼接实现过程。两项技术都涉及特征点检测、几何变换和图像融合等核心步骤,为文档处理、增强现实等应用提供了实用解决方案。
2026-01-26 20:26:48
1502
2
原创 opencv计算机视觉--图形旋转&图形可视化&均衡化
本文介绍了图像处理中的旋转操作和直方图均衡化技术。在图像旋转部分,对比了NumPy的rot90()和OpenCV的rotate()方法,分析了两者在灵活性、可读性和性能上的差异。在直方图分析部分,详细讲解了像素级数据可视化、统计分布可视化和空间选择性可视化方法,包括直方图绘制、颜色通道分离和掩码技术。最后重点阐述了直方图均衡化技术,比较了全局均衡化和自适应均衡化(CLAHE)的特点、参数设置和实际效果,展示了如何通过这两种方法改善图像对比度。全文通过代码示例直观演示了各项技术的具体实现和应用效果。
2026-01-23 19:47:37
1160
原创 深度学习--PyTorch框架&优化器&激活函数
本文介绍了深度学习常用框架(Caffe、TensorFlow、Keras、PyTorch)的特点及PyTorch的安装方法。讲解了使用PyTorch框架实现MNIST手写数字识别的神经网络模型,包括数据加载、模型构建、训练和测试过程。分析了不同优化器(BGD、SGD、Mini-batch、Adam等)的特点及适用场景,并探讨梯度消失/爆炸问题及解决方案(ReLU等激活函数)。通过调整优化器类型和学习率等参数可以显著提升模型准确率。还提供了完整的PyTorch实现代码,展示了从数据预处理到模型训练测试的全流程
2026-01-22 19:24:01
963
原创 深度学习--BP神经网络&梯度下降&损失函数
摘要:深度学习是基于多层神经网络的机器学习方法,通过反向传播算法优化参数。本文介绍了神经网络的基本结构(输入层、隐藏层、输出层)、权重计算和激活函数,重点阐述了感知器、多层感知器的原理及训练方法,包括损失函数(交叉熵、均方差等)、正则化惩罚和梯度下降算法。通过MNIST手写数字识别案例,展示了PyTorch实现神经网络的具体过程,包括数据加载、模型构建(含Dropout层)、训练测试流程,最终达到98%的准确率。实验验证了深度学习在图像分类任务中的有效性。
2026-01-21 18:27:52
1309
原创 机器学习--NLP自然语言处理&词向量转换小案例
自然语言处理是机器学习中让计算机获得“语言智能”的关键领域。从早期的规则系统到如今的大语言模型(LLM),NLP技术已深刻改变我们与机器交互的方式,并广泛应用于搜索引擎、智能助理、内容创作、客户服务等方方面面。它的发展是人工智能向通用智能迈进的重要标志。
2026-01-20 09:08:21
949
原创 opencv计算机视觉--传参方法&银行卡识别&身份证识别案例
本文介绍了使用Python的argparse库进行命令行参数解析的方法,并详细展示了银行卡和身份证识别的实现过程。在参数解析部分,说明了如何定义参数选项、类型和帮助信息。银行卡识别案例通过图像预处理、轮廓检测和模板匹配等技术,实现了自动识别信用卡号的功能。身份证识别部分则采用了类似的流程,包括图像二值化、轮廓筛选和数字匹配等步骤。两个案例都使用了OpenCV进行图像处理,并通过模板匹配算法实现数字识别。文中还提供了详细的代码注释和实现步骤,包括参数设置、图像预处理、轮廓处理以及结果输出等关键环节。
2026-01-19 21:15:34
748
原创 Opencv计算机视觉--轮廓检测
本文介绍了OpenCV中的轮廓检测和模板匹配技术。轮廓检测通过findContours()函数实现,可获取图像中物体的边界轮廓,支持多种检索模式和近似方法,并详细说明了轮廓面积、周长计算及外接几何形状绘制的方法。模板匹配使用matchTemplate()函数,通过不同匹配方法在图像中定位模板位置,适用于目标识别等场景。两种技术都需要进行适当的图像预处理,并注意参数选择和性能优化。
2026-01-19 09:09:27
1386
1
原创 矿物数据训练--8种训练方法
本研究系统评估了8种分类算法在矿物类型预测任务中的性能。使用平均值填充预处理的数据集,分别实现了逻辑回归、随机森林、SVM、AdaBoost、XGBoost、高斯贝叶斯、神经网络和1D CNN等算法,并采用准确率、召回率等指标进行横向对比。各模型在统一测试集上评估后,结果以JSON格式结构化存储。实验结果表明不同算法在该任务上表现各异,其中XGBoost和神经网络等复杂模型展现出较好性能。研究为矿物分类提供了算法选择参考,并建议通过网格搜索进一步优化参数以获得更好效果。
2026-01-16 21:10:21
905
原创 机器学习--矿物数据清洗(六种填充方法)
本文介绍了矿物数据清洗的完整流程与方法。数据清洗通过完整性、全面性、合法性、唯一性检查确保数据质量。针对矿物数据,采用10个步骤进行处理:数据读取筛选、缺失值检查、特征标签分离、标签编码、类型转换、Z标准化、数据集切分、数据填充(提供删除空值、均值/中位数/众数填充、线性回归和随机森林6种方法)、过采样(SMOTE算法)和数据保存。重点阐述了不同填充方法的实现细节,包括按类别计算统计量、基于机器学习模型的预测填充等。清洗后的数据经过标准化和类别平衡处理,为后续建模分析提供可靠基础。
2026-01-15 21:51:41
913
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅