自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

像风一样自由的博客

兴趣是深度学习,神经网络,python

  • 博客(487)
  • 资源 (16)
  • 收藏
  • 关注

原创 算法模型部署后_python脚本API测试指南-记录3

本文提供了多种测试API的方法,包括使用Curl命令和Python脚本。通过Curl命令,用户可以发送图像文件到API并获取预测结果。Python脚本则提供了更灵活的方式,用户可以通过命令行参数指定图像路径,并选择输出详细的JSON响应或简化的预测结果。测试时需确保API服务正在运行,并根据实际情况修改脚本中的URL和图像路径。这些方法适用于不同场景,帮助用户快速验证API的功能和性能。

2025-05-12 15:21:21 762

原创 算法模型部署(非docker版本)- 完整部署文档-ubuntu(香橙派开发板测试)学习记录2

本项目是一个基于机器学习的局部放电(PD)图像识别系统,使用支持向量机(SVM)算法实现对不同类型局放图像的自动分类。系统通过FastAPI框架提供RESTful API服务,可以接收上传的图像并返回识别结果。

2025-04-27 08:15:00 1195

原创 40.数据库Agent的安全设计如何防止误删和越权查询

数据库 Agent 安全设计核心在于“模型提意图,系统定执行”。通过分级工具权限、只读账号隔离、业务 API 替代任意 SQL、租户范围服务端注入、强制人工确认写操作、严格 SQL 解析与审计日志,构建多层防护。关键防线在数据库权限与业务逻辑,而非模型指令。上线前需演练越权、注入、恢复等场景,确保误删与越权无法发生。

2026-09-24 08:42:12 67

原创 39.Agent为什么会循环调用工具从规划执行到终止条件

Agent循环调用工具源于缺乏状态管理与终止条件。本文提出通过结构化工具返回、设置硬性上限(步数、时间、成本)、检测重复调用、区分错误类型、分离规划与执行、追踪进展状态及分层设计终止条件,实现对Agent行为的可控闭环。结合LangGraph的流程控制与监控机制,可有效防止无限循环,提升系统稳定性与安全性。

2026-09-24 00:15:00 672

原创 38.多智能体系统真的更好吗

多智能体系统并非越多越好,其价值在于角色分工清晰、协作成本可控。合理拆分需满足专业差异、工具独立与明确契约;常见协作模式包括主管-专家、流水线、并行与辩论。共享状态应最小化,避免信息污染与成本爆炸。关键在于定义角色输入输出、权限边界与失败处理机制,防止踢皮球与循环失控。治理需设限并发、白名单、证据追溯与裁决节点。最终,单Agent在简单任务中更优,多智能体应以实际复杂度驱动,而非炫技。

2026-09-23 00:30:00 341

原创 37.智能体记忆怎么设计短期记忆长期记忆与用户画像

智能体记忆需分层设计:短期记忆保对话上下文,长期记忆存用户确认的稳定偏好,知识库承载外部资料,工作状态记录任务进展。四类数据分离存储,避免混用。短期记忆按Token预算截断或摘要;长期记忆需来源、时效、权限与用户确认机制。检索时按需注入,避免冗余。使用PostgreSQL存事实、Redis缓存、向量索引辅助召回,确保可重建。记忆写入须经用户确认,冲突数据保留时间线并可追溯。隐私删除需同步清理所有副本,保障合规。核心原则:分层、克制、可审计。

2026-09-22 00:15:00 194

原创 36.LangGraphLlamaIndexDifyn8n工作流工具如何选择

LangGraph、LlamaIndex、Dify 和 n8n 适用于不同场景的 AI 工作流构建。LangGraph 适合精细状态控制与 Agent 编排;LlamaIndex 擅长文档解析与 RAG;Dify 便于低代码快速搭建 AI 应用;n8n 则强于跨系统自动化。选型应区分原型与生产需求,关注控制力、数据能力、部署运维及可迁移性。推荐组合使用:n8n 触发流程,LangGraph 管理状态,LlamaIndex 处理知识,Dify 支持快速验证。避免过度依赖单一平台,确保长期可维护与合规。

2026-09-21 00:15:00 579

原创 35.Tool-Calling是怎么工作的让大模型调用搜索数据库和API

Tool Calling 是大模型与外部系统协作的桥梁,通过结构化调用意图实现安全访问搜索、数据库和 API。模型仅提出请求,应用负责校验参数、权限与上下文,执行工具并返回结果。关键在于:工具定义需清晰,参数必须强校验,敏感操作需用户确认,结果应限大小、去敏感,并记录审计日志。核心原则是“模型提建议,服务端定执行”,确保安全、可控与可追溯。

2026-09-20 00:15:00 328

原创 34.什么是AI-Agent它与普通聊天机器人有什么区别

AI Agent 与普通聊天机器人本质不同:前者是基于状态、工具和控制策略的多步任务执行系统,能规划、调用工具、观察结果并动态决策;后者仅实现单轮问答。Agent 非“更智能的模型”,而是可观测、可约束、可恢复的工程化系统,适用于需多步执行、动态分支的任务。其价值取决于任务完成率、工具成功率与成本收益比,而非对话流畅度。

2026-09-19 00:15:00 247

原创 33.长任务状态管理如何让用户看到文档解析进度

本文系统阐述长任务状态管理的核心实践:以数据库为事实源,细化状态机(如解析、OCR、嵌入等阶段),结合加权进度计算与版本控制,确保状态可追踪、可重试、可恢复。通过SSE/WebSocket实时通知与轮询结合,支持断线重连;强调ready状态必须满足数据可检索,避免虚假完成;并设计取消、超时检测与恢复机制,保障RAG知识库中文件真正可用。

2026-09-18 00:15:00 235

原创 32.RabbitMQKafkaRedis-Stream异步任务组件如何选择

本文对比RabbitMQ、Kafka与Redis Stream在异步任务场景下的适用性:RabbitMQ适合需确认、重试的任务队列;Kafka适用于多消费者、长期保留与事件回放的流处理;Redis Stream则适合已有Redis环境下的轻量级异步需求。选型应基于任务/事件属性、消费模式、保留要求及运维能力,而非单纯追求吞吐。建议统一消息契约,优先验证简单方案,再按规模演进。

2026-09-17 00:15:00 710

原创 31.消息队列在知识库构建中的作用为什么文件上传不能同步处理

文件上传在知识库构建中需异步处理,因解析、OCR、Embedding等任务耗时长且易失败。同步执行会导致超时、重复提交与服务雪崩。消息队列解耦核心流程,通过稳定ID传递任务,实现削峰、重试、扩展与状态追踪。关键在于幂等处理、可靠投递(至少一次)、死信机制及数据库与消息的双写一致性(如Outbox模式)。结合可观测性监控队列深度、延迟与失败率,确保系统健壮。

2026-09-16 00:15:00 447

原创 30.MinIOS3OSS-RAG原始文件应该存在哪里

RAG 系统中,原始文件(PDF、Word 等)应存储于 MinIO、S3 或 OSS 等对象存储,而非直接存入数据库。业务元数据与状态由 PostgreSQL 管理,确保可追溯与权限控制。推荐使用稳定 document_id 关联文件,通过预签名 URL 实现安全上传与下载,并严格校验文件类型、大小、哈希与病毒。派生数据(解析结果、向量等)应可基于原始文件重建。选型需结合部署环境、合规性与运维能力,同时配置生命周期策略与备份机制,保障数据安全与成本可控。

2026-09-15 00:15:00 317

原创 29.Redis在大模型应用中有哪些用途缓存会话与限流

Redis 在大模型应用中充当“加速器与保护层”,主要用于缓存嵌入向量、检索结果和热门问答,降低重复调用成本;通过共享会话存储支持多实例协作;实现基于租户、模型、知识库版本的精细化限流。缓存键需包含关键维度以保证一致性,采用 TTL、主动删除或版本化策略应对失效问题。避免将核心数据仅存于 Redis,确保事实源在持久化系统中,并制定降级方案。上线需检查缓存维度、过期策略、原子性及监控指标,保障系统稳定高效。

2026-09-14 00:15:00 436

原创 28.知识库为什么会答错RAG常见失败模式与排查方法

RAG 答错源于数据链路多环节故障,常见模式包括:文件未正确入库、Chunk 切分破坏语义、旧版本混入、权限过滤失效、上下文幻觉及结构化问题误用语义检索。排查需贯穿全链路追踪 trace_id,逐段验证解析、切分、向量写入、检索过滤与生成逻辑。关键措施包括:版本控制、权限前置过滤、严格 Prompt 约束、引用可验证、结构化查询路由,并建立回归测试与日志可观测体系,实现从“调 Prompt”到工程化诊断的转变。

2026-09-12 00:15:00 279

原创 27.RAG召回率与准确率怎么提升从查询改写到重排序

本文系统探讨RAG召回率与准确率的提升路径,强调需区分召回与排序问题,建立可复现的评测链路。通过查询改写、多路召回、合理设置Top K、引入Reranker、去重过滤及阈值控制等策略,优化检索链路。建议按固定变量实验,结构化记录效果与成本,确保生产可用性。最终目标是让大模型获取高质量上下文,实现精准回答。

2026-09-11 00:15:00 322

原创 26.混合检索是什么关键词检索与向量检索如何结合

<think>我们要求根据内容生成≤150字的文章摘要。需要简明扼要概括混合检索的定义、为何需要、如何结合(例如RRF、Milvus),以及注意事项。字数限制150字(中文)。需注意摘要应涵盖核心要点。可以写:混合检索结合向量检索的语义理解与关键词检索的精确匹配,解决单一检索的局限。流程包括两路召回、合并去重、RRF或加权融合、重排。在Milvus中可通过混合搜索实现,需维护一致索引并动态调权,同时注意成本和评测。结尾强调混合检索是候选生成而非最终答案,需配合Reranker等。压缩到150字以内。</th

2026-09-10 00:15:00 495

原创 25.元数据设计知识库为什么不能只保存一段文本和一个向量

<think>我们只需要根据内容生成摘要,不超过150字。摘要要概括文章主旨:知识库需要元数据设计,不能只保存文本和向量,需要分层(原始文件、业务元数据、检索索引),元数据支持权限、版本、删除、引用等,并推荐用PostgreSQL存事实,向量库存副本。结尾提及解决检索可靠性。</think>知识库不能只存文本和向量,需设计元数据支撑权限、版本、删除、引用与审计。建议分三层:对象存储存文件,PostgreSQL存业务事实,Milvus/pgvector存检索副本。权限由服务端控制,版本原子切换,删除用稳定ID

2026-09-09 00:30:00 174

原创 24.文本切分怎么做Chunk大小重叠和语义边界

<think>我们需要根据用户要求生成摘要:根据给定的内容,生成≤150字的文章摘要。给定内容是中文技术文章,关于文本切分。需要提炼核心观点。摘要要简洁,覆盖主要要点:切分目标、方法(先结构后长度)、参数(chunk大小、重叠)、元数据、评估等。字数限制严格≤150字(中文字符)。我们需要写一段摘要,不遗漏核心。检查字符数。 先理解内容:文章讲RAG中文本切分(Chunk)重要性,切分目标(完整、可区分、可追溯),推荐按结构切再按长度切,chunk大小和重叠需实验,不同内容策略,添加上下文头,元数据,版本化

2026-09-08 00:15:00 649

原创 23.OCR在知识库中的作用扫描件和图片文字如何进入RAG

<think>我们需要根据用户提供的文章内容生成一个不超过150字的摘要。用户说“根据以下内容,生成≤150字的文章摘要”。文章是关于OCR在知识库/RAG中的作用。摘要需要简洁总结核心要点。 先阅读文章。文章主要讲OCR在RAG中不只是转文字,而是结构化提取,包括坐标、置信度等,需要预处理、表格处理、置信度策略、元数据保留、图片语义区分、隐私安全等。 摘要应涵盖:OCR作为带不确定性的解析器,输出结构化结果(文本+坐标+置信度),用于RAG的解析链路;需要预处理、表格结构化、置信度分级处理;保留页码和原图

2026-09-07 00:15:00 352

原创 22.PDFWordExcel和图片文档解析为什么是RAG的第一道难题

<think>用户要求基于输入内容生成一篇不超过150字的文章摘要。输入内容是关于文档解析在RAG中的作用,是“码海寻道”系列第22篇。我需要提炼关键要点:解析是整个流程第一道难题,不同文件格式需要不同解析策略,要保留结构信息和元数据,解析器应作为可替换组件,要验证质量并避免静默失败。摘要限150字,需要精炼。</think>文档解析是RAG流程的第一道难题,需将PDF、Word、Excel等文件转换为带页码、坐标、表格结构等元数据的统一Block,而非纯文本。不同格式需采用不同策略(如PDF处理双栏与页眉

2026-09-05 00:15:00 337

原创 21.RAG的完整流程从上传文件到生成答案

<think>我们只需根据给定的中文技术文章生成一个≤150字的摘要。需要捕捉核心内容:RAG两条链路(入库与问答),工程分层(事实/处理/检索),关键点:对象存储、PostgreSQL、向量库、异步处理、幂等、权限、可观测性。最终一句话概括。字数限制150,中文约100-150字。注意摘要要求≤150字,所以简短。我们写一段连贯的文字。</think>本文介绍了RAG完整流程:从文件上传经解析、切分、向量化写入Milvus/pgvector,到用户问题经改写、检索、重排后拼装Prompt生成带引用答案。强

2026-09-04 00:15:00 591

原创 20.Milvus常见问题检索不到维度错误和数据一致性

<think>我们根据要求生成≤150字的文章摘要。内容是关于Milvus常见问题排查的。需要提炼核心要点。输出中文摘要,字数控制在150字以内。</think>本文系统梳理了 Milvus 检索不到、维度错误和数据一致性三类问题的排查路径,强调先分类再查日志,避免误判。建议从连接与环境、Schema 与字段、数据写入与加载、过滤条件、模型维度与一致性逐层检查,并配合版本化 Collection、状态同步和可观测日志保障链路可靠。

2026-09-03 00:15:00 681

原创 19.Milvus数据分片扩展与高并发设计

<think>我们根据内容生成摘要,≤150字,中文。要涵盖主要点:三种部署形态、分片/分区/查询节点区别、etcd/MinIO/WAL角色、扩展信号、读写分离、租户隔离、高并发参数、指标、生产化分层、不要过早K8s等。需要精简。我们开始。</think>Milvus生产环境需区分Partition(逻辑分组)、Shard(写入分片)与Query Node(查询扩展),并理解Standalone、Distributed、etcd、MinIO及WAL各自职责。扩展应基于延迟、CPU、并发等指标,而非向量数量。

2026-09-02 00:15:00 700

原创 18.Milvus索引怎么选从FLATIVF到HNSW

FLAT 适合作为精确基线,IVF_FLAT 适合通过候选聚类控制搜索范围,HNSW 适合对低延迟和较高召回有要求的在线检索。真正的选型方式是建立评测集和压测矩阵,用数据决定,而不是凭“高级感”决定。下一篇将进入更大规模的 Milvus 架构,讨论分片、扩展和高并发设计。

2026-09-01 00:15:00 291

原创 17.Milvus如何完成一次向量相似度检索

一次向量检索不是简单的“传入向量、返回结果”,而是模型、Schema、索引、过滤、一致性和资源状态共同作用的结果。掌握这条链路,才能在出现空结果、错结果和慢查询时快速定位。下一篇将重点比较 FLAT、IVF 和 HNSW,回答“Milvus 索引到底应该怎么选”。

2026-08-31 00:15:00 182

原创 16.Milvus的CollectionPartition向量字段分别是什么

Collection 负责组织一类向量实体,Field 负责描述记录结构,Partition 负责在集合内部进行逻辑划分。理解三者关系后,Milvus 的建模就不再是“照着示例复制 Schema”,而是可以从检索模式、权限边界和数据生命周期反推设计。下一篇将沿着一次真实查询,解释 Milvus 如何从查询向量走到 Top K 结果。

2026-08-29 00:15:00 341

原创 15.Milvus是什么?为什么RAG系统经常使用它?

Milvus 可以理解为 RAG 系统中的“专用向量检索层”:它让向量存储、索引和大规模相似度搜索拥有独立的工程能力,但它并不替代模型、业务数据库和知识库处理流程。下一篇将继续拆解 Milvus 的数据模型:Collection、Partition 和向量字段分别是什么,以及它们应该如何映射到知识库业务。

2026-08-28 00:15:00 674

原创 新版ChatGPT (Codex) 桌面版启动失败排查与修复记录

打开 ChatGPT 桌面版(微软商店 MSIX 包 )时报错:安装包文件被打上了 EFS 加密属性通过 证实:整个 目录与其中的 (以及 )均带有 属性:本机 EFS 加密功能不可用测试 抛出 ,说明系统不支持进行 EFS 加密操作。复制过程会尝试保持加密状态Windows 的 (应用使用的 Rust 底层)在复制带 属性的文件时,会在目标位置尝试重建加密。由于本机 EFS 不可用,会返回错误码 = (“无法加密指定的文件”)。结果应用的「重定位」步骤(从 → )失败,导致所有候选

2026-08-27 09:20:16 1020

原创 14.什么时候用pgvector什么时候单独部署Milvus

pgvector 和 Milvus 不是“入门方案”和“高级方案”的简单关系。pgvector 的核心优势是把向量检索与 PostgreSQL 的业务数据、SQL、事务和权限结合起来;Milvus 的核心优势是为专用向量检索提供更强的规模、索引和独立扩展能力。最稳妥的路线通常是:先使用能快速验证业务闭环的方案,持续收集召回率、延迟、资源和运维数据,等瓶颈真实出现后再拆分。至此,第三篇章“PostgreSQL 与业务数据”全部完成。下一篇章将进入 Milvus 与向量数据库,从《Milvus 是什么?

2026-08-27 00:15:00 582

原创 13.pgvector入门用PostgreSQL直接实现向量检

pgvector 让 PostgreSQL 可以直接保存向量并执行相似度搜索。对于中小型 RAG、原型和关系查询占主导的应用,它能以较低的系统复杂度完成完整闭环。但当向量规模、并发、隔离和扩展需求不断增长时,仍然要用真实数据评估它的边界。下一篇:《什么时候用 pgvector,什么时候单独部署 Milvus?

2026-08-26 00:15:00 333

原创 12.JSONB全文检索与事务PostgreSQL适合哪些AI业务数据

JSONB 给了 AI 应用必要的灵活性,全文检索提供了不依赖向量模型的词项检索,事务和并发控制则让文档、任务和业务状态能够可靠变化。它们组合起来,正好适合承载 AI 应用中“既有结构化事实,又有半结构化模型数据”的部分。下一篇进入向量能力:《pgvector 入门:用 PostgreSQL 直接实现向量检索》

2026-08-25 00:15:00 807

原创 11.PostgreSQ、-MySQL与MongoDB-AI应用如何选择数据库

PostgreSQL 适合关系、事务、JSONB、全文检索和较完整的 AI 业务数据;MySQL 适合复用成熟的企业业务体系;MongoDB 适合结构灵活、文档化程度高的对象。真正重要的不是追逐某个“AI 首选数据库”,而是明确数据事实源、权限边界、查询模式和未来演进路径。下一篇进入 PostgreSQL 的具体能力:《JSONB、全文检索与事务:PostgreSQL 适合哪些 AI 业务数据?

2026-08-24 00:15:00 763

原创 10.PostgreSQL在大模型项目中到底负责什么

在大模型项目中,PostgreSQL 最重要的价值不是“能不能存一段 JSON”,而是把 AI 应用从一次模型调用,变成一个有身份、有状态、有权限、有版本、有审计的业务系统。模型负责理解和生成,向量库负责相似度检索,对象存储负责原始文件,而 PostgreSQL 负责把这些对象组织成可以被业务理解和管理的事实。下一篇继续讨论数据库选型:《PostgreSQL、MySQL 与 MongoDB:AI 应用该如何选择数据库?

2026-08-22 00:15:00 352

原创 9.大模型上下文窗口、Token 与成本:开发者必须理解的三个概念

本文探讨了大模型应用开发中的三个核心概念:Token、上下文窗口和成本。Token作为模型处理文本的基本单元,其计算方式因模型而异,开发者需使用目标模型对应的Tokenizer准确估算。上下文窗口决定了模型单次请求的处理范围,应用需合理分配输入与输出预算。成本则与Token数量直接相关,受多轮对话、RAG检索和Agent工具调用等因素影响显著。文章提出了12条优化建议,包括减少无效输入、分层使用模型、缓存稳定结果等,强调在压缩上下文时需保留来源信息以保证可追溯性,并建议监控关键Token指标以平衡成本与质量

2026-08-21 00:15:00 654

原创 从租 GPU 到本地运行:一次完整的大模型微调实操记录

基座模型:Qwen3-1.7B(1.7B 参数,练手/垂直领域微调完全够用)微调方法:LoRA(rank 16 / alpha 32),只训练低秩矩阵,不动原模型权重训练数据:高压电缆局部放电问答 120 条 + 身份问答 20 条 + 虚构公司规范 76 条,合并后训练集 169 条、测试集 47 条硬件:AutoDL 云平台,一张 NVIDIA GeForce RTX 3080 Ti(12GB 显存),按量计费SSH 工具。

2026-08-20 15:05:57 309

原创 8.Reranker重排序是什么为什么向量检索后还要再排一次

文章摘要: Reranker是RAG系统中的重要组件,负责对向量检索初步召回的候选结果进行精细重排序。它与Embedding模型形成两阶段检索流程:先用向量模型快速召回候选(Top K),再用Reranker精排(Top N)。两者的核心区别在于:Embedding单独编码文本输出向量,适合大规模召回;Reranker则对问题-候选文本对联合计算,输出相关性分数,精度更高但计算成本更大。典型应用场景是处理多条件查询或需要细粒度匹配的情况。工程实现需注意候选数量平衡(K>N)、混合检索策略(结合关键词)、计算

2026-08-20 00:15:00 371

原创 每天 1000 万 Token,免费云端 AI 编程平台 MonkeyCode 上手指南

《每天1000万Token的免费云端AI编程平台MonkeyCode使用指南》介绍了这款新兴的在线开发工具。该平台为免费用户提供每日1000万Token的基础模型额度,支持浏览器端直接创建任务、修改代码和在线预览,适合快速原型开发和小工具制作。文章详细说明了注册流程、任务创建方法和使用技巧,建议将大需求拆解为小任务、提供明确验收标准以优化Token使用效率。同时提醒用户注意数据安全,避免上传敏感信息。平台支持GitHub/GitLab集成但非必须,邀请注册可获得积分奖励。最后推荐从小项目入手体验完整开发流程

2026-08-19 18:26:20 748

原创 7.如何选择Embedding模型从维度中文能力到成本

摘要: 如何选择适合的Embedding模型?本文从任务适配、维度权衡、中文能力、输入长度、部署方式等维度分析了选型关键点。强调模型需匹配具体场景(如语义检索、聚类、推荐),而非盲目追求高维度或榜单排名。中文能力需用真实数据验证,部署需考虑API与本地模型的成本、合规及运维差异。同时指出模型升级需重建索引,避免向量空间混用。最后提供选型流程与检查清单,建议通过真实业务评测确定最优模型,而非仅依赖名词热度。

2026-08-19 00:15:00 356

原创 6.向量相似度是怎么计算的?从余弦距离到语义检索

本文介绍了向量相似度计算的关键概念和方法,重点讨论了余弦相似度、内积和欧氏距离三种常见指标的差异与应用场景。文章指出,选择距离指标本质上是在定义系统的"相似"标准,并强调工程实践中容易混淆的问题:不同指标的排序方向可能相反,组件间必须保持一致的指标约定。作者详细阐述了Top K和相似度阈值的作用与权衡,解释了近似最近邻搜索(ANN)的必要性,并提醒不能将检索分数直接等同于答案可信度。文章最后提供了Python示例代码和上线前的检查清单,帮助开发者正确实现语义检索系统。

2026-08-18 00:15:00 287

电力领域gis局部放电的PRPD图谱详解

内容概要:本文围绕局部放电(PD)监测中的PRPD图谱展开,详细介绍了PRPD图的生成原理及其在局放检测中的关键作用,强调良好的相位同步对数据质量的重要性。通过对比不同同步效果的图谱,说明高质量数据对准确识别局放信号的意义,并结合实际案例解析了内部空隙型放电源的诊断方法。同时,文章推荐了多篇关于GIS设备中PRPD/PRPS图谱原理与应用的技术博客,辅助深入理解分析算法的选择与应用。最后展示了GIS局放在线监测系统的前端Demo,涵盖实时数据、谱图展示、告警机制和诊断分析等功能,可作为中高端产品原型参考。; 适合人群:电力系统相关技术人员、从事高压设备状态监测的研发人员或工程师,具备一定电气知识和数据分析基础者更佳; 使用场景及目标:①用于理解PRPD/PRPS图谱的形成机制及其在GIS局部放电监测中的应用;②指导如何通过图谱进行局放类型识别与故障诊断;③为开发局放监测系统提供前端界面设计与功能实现参考; 阅读建议:建议结合文中提供的CSDN博客资源深入学习算法细节,并通过Demo系统实践图谱展示与分析流程,注重理论与实际工程应用的结合。

2025-09-12

svm-project-适用x86-64架构的dockerfile文件与完整镜像文件.7z

适用linux/amd64(x86_64)架构的机器上运行 Docker 容器,,而不是使用树莓派开发板 ARM64 架构的完整镜像。 文件,包含了完整的 Docker 镜像。可直接部署到其他系统上进行测试。注意适用的是x86_64架构上的不同系统。

2024-09-13

svm-fastapi-app.tar 一个名为 svm-fastapi-app.tar 的文件,包含了完整的 Docker

导出 Docker 镜像为 .tar 文件: 使用 docker save 命令将 Docker 镜像导出为一个 .tar 文件: docker save -o svm_fastapi_app.tar svm_fastapi_app 这会在当前目录下创建一个名为 svm_fastapi_app.tar 的文件,包含了完整的 Docker 镜像。 可直接部署到其他系统上进行测试。

2024-09-12

9-11-docker-svm-fastapi.zip

在树莓派5开发板-Ubuntu系统上安装docker容器测试项目 打包项目文件: 创建一个新文件夹(例如 svm_project),将所有项目文件放入其中,包括: main.py(主代码文件) templates 文件夹(包含 HTML 模板文件,如 index.html 和 result.html) static 文件夹(包含静态文件,如 CSS、JavaScript、上传目录等) 任何其他模型文件(例如 svm_model_noise.pkl、svm_scaler_noise.pkl、svm_pca_noise.pkl)

2024-09-12

LabelImg是目标检测数据标注工具,可以标注两种格式: VOC标签格式和YOLO标签格式

LabelImg是目标检测数据标注工具,可以标注两种格式: VOC标签格式,标注的标签存储在xml文件 YOLO标签格式,标注的标签存储在txt文件中

2024-06-26

车辆检测的视频,视频来自YouTube,Los Angeles Freeway I-101 HD 30fps traffic

2021年10月16日下午6:55,用iPhone SE 2在历史悠久的菲律宾小镇(加利福尼亚州洛杉矶)的贝尔蒙特大道上录制。 周六晚上,汽车在101路上缓慢行驶,没有人声。

2024-06-20

基于OpencvDNN和ONNXRuntime部署YOLOv7(源码+训练模型+说明文档+数据)包含C++和Python两个版本

1、包含C++和Python两个版本的程序 2、代码特点:参数化编程、参数可方便更改、代码编程思路清晰、注释明细。 3、适用对象:计算机,电子信息工程、数学等专业的大学生课程设计和毕业设计。

2024-06-14

高光谱数据集(.mat.csv)-科研学术

高光谱数据集包含后缀为(.csv.mat格式),主要先将.mat转成.csv,145x145x220,csv数据,每行代表一个数据,每行前220列是特征,最后1列是标签值,共17类

2024-05-29

movie-score-info.csv

这个movie_score_info文件是B站的一位昵称为“末末凉凉”的美女小姐姐做电影推荐系统所缺少的一个文件,文件字段为movieId,score,times,需要的话请自行下载

2020-05-15

卷积神经网络-源代码.rar

这是我的博客文章:基于深度学习的CIFAR10图像分类 的源代码。 本文实验基于Windows10系统,仿真软件用的是Anaconda下基于python编程的JupyterNotebook编辑器。通过利用Google的深度学习框架Tensorflow,搭建新的卷积网络结构,提出了基于卷积神经网络的CIFAR10图像分类识别算法,主要参照经典的卷积神经网络模型LeNet-5结构,提出新的卷积神经网络结构并对飞机、汽车、鸟类、猫、鹿、狗、蛙类、马、船和卡车10种事物进行分类,该模型构建了一个输入层、三个卷积层、三个池化层、一个全连接层和一个输出层。

2020-11-28

源码工程文件-libmodbus-test

源码工程文件-libmodbus-test

2024-05-15

libmodbus-3.1.4-源码与已编译好的

适用于Qt的libmodbus版本3.1.4源码与已编译好的

2024-05-15

Qt-libmodus

Qt-libmodus

2024-05-14

pip-script.zip

把这个压缩包解压后,放在anaconda安装路径的Scripts文件下, 然后打开cmd窗口,先pip install --upgrade pip 之后就可以像平时那样安装库了

2020-06-01

最新Landmark人脸68个关键点检测dat模型库-数据亲测真实可用.zip

dat文件,具体名称为shape_predictor_68_face_landmarks.dat 人脸68个关键点:嘴巴,鼻子,眼睛,眉毛,轮廓等 Landmark人脸68个关键点检测dat模型库

2020-04-07

Pillow-7.0.0-cp37-cp37m-win_适用于windows64和32位操作系统

适用于windows64位操作系统,下载后直接pip install Pillow-5.4.1-cp37-cp37m-win_amd64.whl 即可安装(注意文件路径要对).文件中也有Windows32位的whl

2020-04-07

波士顿房价预测 数据集data.rar

人工智能,机器学习最好的案例,数据集真实有效 波士顿房价预测 数据集 多元线性回归模型-最好的数据集

2019-10-20

ml-latest.zip

MovieLens最新数据集-完整版 完整版:280,000名用户将27,000,000个评级和1,100,000个标签应用程序应用于58,000部电影。包括在1,100个标签中具有1400万相关分数的标签基因组数据。上次更新时间9/2018。

2020-05-06

python-遗传算法求四元函数极值.zip

这个代码是在三元函数求极值上的代码上改写的,如果你看了我遗传算法求三元函数的代码,你就不用下了,代码大部分不变,改的不多,你基本自己就能改出来了。

2020-06-13

yolov5m.pt与yolo5s.pt预训练模型.zip

yoloV5预训练模型,官方给的是谷歌网盘下载地址,下载速度较慢,压缩包包含yolov5m.pt,yolov5s.pt

2021-08-12

cifar10数据集.rar

CIFAR-10(Canadian Institute for Advanced Research,CIFAR)是一个用于识别普适物体的小型数据集。由Hinton 的学生Alex Krizhevsky 和Ilya Sutskever 整理的一个用于识别普适物体的小型数据集。一共包含10个类别的RGB 彩色图片:飞机(airplane)、汽车(automobile)、鸟类(bird)、猫(cat)、鹿(deer)、狗(dog)、蛙类(frog)、马(horse)、船(ship)和卡车(truck)。

2020-05-05

GAN-fashion-mnist.zip

代码是实现利用GAN生成fashion-mnist图像 用TensorFlow深度学习框架 需要按照anaconda,jupyter

2020-11-29

python遗传算法旅行商代码.zip

这是完整代码,包括csv城市文件,python语言实现,是在别人的代码基础上改的,具体参考网址,在《遗传算法解决旅行商问题-Python》讲得很清楚。想知道更详细的朋友,请去看吧。

2020-06-22

遗传算法实现TSP的完整代码.zip

程序会动态的展示迭代过程,40以内城市大概迭代500次能收敛到最优; 这里是用中国城市地理坐标直接做欧式距离计算,实际上可以根据问题作出调整。

2020-05-05

opencv_python-3.4.7.28-cp37-cp37m-win_amd64.whl

机器学习-计算机视觉的库 opencv_python-3.4.7.28-cp37-cp37m-win_amd64.whl

2020-04-26

冠状病毒确诊数据.zip

国内各个省份冠状确诊数据,时间从2020-1月30日到2020-3月24日, 文件格式是CSV,具体字段为cityName,confirmedCount,suspectedCount,curedCount,deadCount,provinceName

2020-04-07

手写体识别数据集-mnist.rar

MNIST 数据集来自美国国家标准与技术研究所,National Institute of Standards and Technology(NIST). 数据集由来自250个不同人手写的数字构成,其中50%是高中学生,50%来自人口普查局(the Census Bureau)的工作人员 此数据集中,训练样本:共60000个,其中55000个用于训练,另外5000个用于验证 测试样本:共10000个 3、数据集中像素值 a)使用python读取二进制文件方法读取mnist数据集,则读进来的图像像素值为0-255之间;标签是0-9的数值。 b)采用TensorFlow的封装的函数读取mnist,则读进来的图像像素值为0-1之间;标签是0-1值组成的大小为1*10的行向量。

2020-05-07

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除