自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

牧子川的博客

对python、图像处理的学习

  • 博客(179)
  • 资源 (2)
  • 收藏
  • 关注

原创 工具依赖关系处理:让 Agent 学会“chaining“

当工具之间存在依赖关系——Tool B 需要 Tool A 的输出作为输入——Agent 该如何处理?本文介绍四种策略:ReAct 多步推理、LangGraph StateGraph、LCEL 链式组合和复合工具封装,帮你彻底解决工具依赖链的数据传递问题。

2026-08-08 08:00:00 619

原创 避免相似工具混淆:让 Agent 不再“选错门“

当 Agent 拥有多个功能相似的工具时,很容易"选错门"——把网页搜索当成知识库检索,把摄氏度转换当成华氏度转换。本文总结了 5 种实用策略:命名区分、正反场景描述、参数差异化、系统提示词引导、中间件路由,帮助你让 Agent 精准选择正确的工具。

2026-08-06 15:06:41 328

原创 何时拒绝使用工具:Agent 不是万能钥匙

Agent 的核心能力之一是调用工具,但"有能力调用"不等于"应该调用"。本文探讨 Agent 何时应该拒绝使用工具,以及如何通过 System Prompt、工具描述和条件边来引导 Agent 做出正确判断。

2026-07-23 15:23:50 161

原创 生产级异步工具:用 async def 打造高性能 Agent

当 Agent 需要调用外部 API、查询数据库时,同步工具会阻塞整个事件循环。本文教你用 async def 编写生产级异步工具,实现并发执行、结构化错误处理和优雅降级,让 Agent 性能提升数倍。

2026-07-15 15:04:23 150

原创 工具错误处理:让 Agent 优雅应对每一次失败

工具错误处理的核心不是"避免错误",而是"让 Agent 看到错误"。不抛异常、返回错误信息、实现重试,让 Agent 具备自修正能力。

2026-07-09 15:49:48 377

原创 工具命名与描述:让 Agent 精准调用的一线生机

工具命名和描述是影响 Agent 工具调用准确率的关键。好的命名让工具自解释,好的描述让模型知道何时用、何时不用。

2026-07-06 01:50:45 163

原创 Agent 工具开发:Pydantic 模型使用指南

掌握使用 Pydantic BaseModel 定义复杂工具参数Schema,实现嵌套结构、字段验证和类型安全。

2026-06-29 14:54:47 194

原创 LangChain 如何让 AI 自动理解你的函数?JSON Schema 自动生成详解

本文深入解析 @tool 装饰器如何通过 Python 反射和 Pydantic 动态模型,将函数签名自动转换为标准 JSON Schema,让 AI 能够准确理解工具的参数结构。

2026-06-11 21:02:51 232

原创 LangChain @tool 装饰器:让函数秒变 Agent 工具

本文深入解析 LangChain 的 @tool装饰器,探讨如何通过最少的样板代码将普通 Python 函数转换为 Agent 可调用的智能工具,以及如何设计高质量的工具描述和错误处理机制。

2026-05-29 20:42:44 284

原创 Tool Calling 深度实践:四种模式与并行调用的完整指南

深入掌握 Tool Calling 的 tool_choice 四种模式(auto/any/具体工具名/disabled)、.bind_tools() 绑定语法和 parallel_tool_call 并行调用机制,让你的 Agent 更高效、更可控地调用外部工具。

2026-05-26 14:20:29 446

原创 从零搭建 AI 搜索引擎:我给装上了智能记忆,还踩了这些坑

基于Vibe Coding 实现从零开发 AI 搜索浏览器

2026-05-22 20:57:36 425

原创 Function Calling 实战:让 LLM 拥有调用外部工具的能力

通过工具注册、模型决策、工具执行和结果整合四步流程,让大语言模型能够调用外部工具,突破知识限制,实现实时数据查询和业务系统集成。

2026-05-21 15:14:39 427

原创 结构化输出实战:用 Pydantic + Function Calling 让 LLM 返回可靠数据

结合 Pydantic 数据验证、JSON 格式控制和函数调用,掌握 with_structured_output() 高级 API 和手动 Chain 构建两种方案,构建可靠的 AI 结构化输出系统。

2026-05-20 16:28:24 385

原创 国产大模型 API 封装:一套接口调用智谱、通义千问等国产模型

通过抽象基类 BaseModelClient 统一不同厂商的 SDK 接口,实现异步聊天调用、费用计算和智能路由推荐,让国产大模型调用像调用统一服务一样简单。

2026-05-17 13:25:13 520

原创 多模型 API 调用:一套代码同时调用 GPT、Claude 等大模型

通过构建 MultiModelComparator 架构,抽象不同厂商 SDK 差异,实现并发调用多个大模型并对比响应内容、延迟和 Token 消耗。

2026-05-16 15:00:19 453

原创 Chain-of-Thought Prompting:让 AI “说出思考过程“的推理魔法

Chain-of-Thought(思维链)提示通过让模型展示推理过程,将隐式的多步计算转化为显式的序列生成,显著提高数学、逻辑等复杂推理任务的准确性。

2026-05-15 14:46:15 536

原创 Multi-Head Attention:让 AI 拥有“多个大脑“同时思考

Multi-Head Attention(多头注意力)通过将注意力分成多个并行子空间,让模型能同时捕获语法、语义、长距离等不同类型的关系,是 Transformer 表达能力的关键。

2026-05-14 11:27:25 409

原创 Self-Attention 机制:让 AI 真正理解上下文的“核心引擎“

Self-Attention(自注意力)是 Transformer 的"心脏",它通过 QKV 机制让序列中的每个词都能与其他词直接"对话",彻底解决了 RNN 的长遗忘问题。

2026-05-13 10:49:36 218

原创 Transformer 架构:大语言模型的“心脏“

Transformer 是 ChatGPT、Claude 等所有大语言模型的基础架构。它通过"自注意力"机制解决了 RNN 的长遗忘问题,让 AI 真正能理解长文本。

2026-05-12 13:54:30 957

原创 LCEL 管道编程:理解数据如何在 AI 组件间流动

LCEL 的核心是 Runnable 协议——所有 AI 组件共享同一套接口。掌握数据流转和类型匹配,你就能像搭积木一样构建任意复杂的 AI 工作流。

2026-05-11 16:32:46 532

原创 LangChain LCEL:用管道符串联你的 AI 工作流

LCEL 是 LangChain 的表达式语言,通过管道符 `|` 将多个 AI 组件串联成数据流水线,让复杂的工作流定义变得像搭积木一样简单。

2026-05-10 17:55:41 343

原创 Skill、MCP 与 Tool:AI 的三种“动手“方式

Skill、MCP 和 Tool 调用是 AI 应用开发中的三种核心技术,分别解决了"做什么"、"如何连"和"如何调"三个层面的问题。理解它们的区别,才能构建高效的 AI 系统。

2026-05-09 15:07:11 449

原创 RAG vs Agent:AI 应用的两种核心范式

RAG 让 AI"查资料再回答",适合知识问答;Agent 让 AI"想清楚、动手干",

2026-05-08 21:06:36 436

原创 一文读懂 Temperature 参数:AI 的“创意旋钮“

Temperature(温度)是控制 AI 输出确定性与多样性的核心参数,就像调节创意的"旋钮"——低温稳定可靠,高温充满想象。

2026-05-07 15:01:17 435

原创 JSON 格式输出控制:如何让 AI 每次都返回完美的结构化数据?

大模型天生不擅长输出严格的 JSON 格式。本文教你如何通过 Schema 验证、自动修复和提示工程,确保 AI 每次都返回合法、可用的结构化数据。

2026-05-06 14:49:38 233

原创 少样本提示(Few-shot Prompting):为什么给 AI 几个例子就能让它变聪明?

Few-shot Prompting 通过给模型提供少量示例,让它快速理解任务格式和映射规则。

2026-05-05 19:09:08 481

原创 零样本提示(Zero-shot Prompting):为什么 AI 能听懂你没教过的事?

Zero-shot Prompting 是一种让 AI 模型在没有示例的情况下,仅通过指令就能完成任务的技术

2026-05-04 13:31:26 394

原创 【YOLO 系列】基于YOLO的车载摄像头道路标志和车辆目标检测识别系统【python源码+Pyqt5界面+数据集+训练代码】

在传统的交通管理和智能驾驶领域,道路标志和车辆的检测通常依赖人工观察或传统的计算机视觉方法,这种方式不仅效率低下,容易出现漏检和误检的情况,而且在复杂的路况和恶劣的天气条件下,检测的准确性和实时性难以保证。而基于 YOLO 的道路标志和车辆目标检测系统,通过安装在车辆或道路监控设备上的摄像头,实时捕捉道路的图像信息,再利用先进的算法进行分析处理,能够快速、准确地识别出道路标志和车辆的位置和类型,从而实现自动化检测,大大节省了时间和人力成本。

2025-06-14 11:28:50 1443

原创 【YOLO 系列】基于YOLO的飞机表面缺陷智能检测系统【python源码+Pyqt5界面+数据集+训练代码】

本文介绍了基于YOLOv8的飞机表面缺陷智能检测系统,该系统通过深度学习技术实现了飞机表面缺陷(如裂纹、凹陷等)的自动化检测,显著提升了检测效率和准确性。系统采用PyQt5搭建可视化界面,支持图片、视频及摄像头的实时检测,并具备结果保存功能。文章详细阐述了环境搭建、算法原理(包括改进的C3K2和C2PSA模块)、数据集准备(1250张标注图片)、模型训练与评估过程,以及推理应用效果。该系统具有高准确性、实时性和鲁棒性,可广泛应用于航空安全监控、飞机维护等领域。完整代码和资源文件已打包提供下载。

2025-06-05 18:57:21 1616

原创 【目标检测数据集】电动车驾驶员戴头盔相关数据集

摘要:本文介绍了两个电动车头盔检测数据集:1) TWHD数据集包含5026张图片,标注了15348个戴头盔、7876个未戴头盔和16759个双轮车目标;2) 国内道路数据集包含5255张图片,标注了4926个戴头盔、4221个未戴头盔和8158个双轮车目标。两个数据集均包含三类标注(头盔/未戴头盔/双轮车),数据来源包括开源数据集和网络爬取图像,可用于电动车头盔检测算法开发。

2025-06-02 11:57:57 1243 1

原创 【论文解读】CVPR2023 PoseFormerV2:3D人体姿态估计(附论文地址)

PoseFormerV2,通过探索频率域来提高 3D 人体姿态估计的效率和鲁棒性。PoseFormerV2 利用离散余弦变换(DCT)将骨骼序列转换为低频系数,显著减少了计算量并提高了对噪声的抵抗力。

2025-05-30 11:14:41 2030

原创 【YOLO 系列】基于YOLO的道路坑洞检测识别系统【python源码+Pyqt5界面+数据集+训练代码】

本文介绍了一种基于YOLO模型的道路坑洞检测系统,旨在提高道路维护的效率和安全性。系统采用Pyqt5库搭建用户界面,支持图片、视频和摄像头的检测,并能保存检测结果。通过本项目,期望为道路维护和管理提供技术支持,推动智能交通和城市管理的智能化升级。

2025-05-15 18:24:01 1009

原创 Lora 代码参数介绍并实战【命名实体微调、自定义模型输出格式】

本文档主要节Lora微调的参数含义以及代码实战

2025-05-06 10:44:51 1627

原创 【YOLO 系列】基于YOLO的涡轮机叶片(风机扇叶)缺陷检测系统【python源码+Pyqt5界面+数据集+训练代码】

在现代工业生产中,涡轮机叶片(风机扇叶)的缺陷检测是确保设备安全运行和高效生产的关键环节。传统的检测方法通常依赖人工目检,这种方式不仅效率低下,容易出现漏检和误检的情况,而且在高强度的工作环境下,检测人员的疲劳也可能导致检测质量下降。而基于 YOLO 的涡轮机叶片缺陷检测系统,通过安装在设备周围的摄像头,实时捕捉叶片的图像信息,再利用先进的算法进行分析处理,能够快速、准确地识别出叶片的缺陷类型和位置,从而实现自动化检测,大大节省了时间和人力成本。

2025-04-11 09:45:00 2449

原创 【YOLO 系列】基于YOLO的智能零售柜商品检测系统【python源码+Pyqt5界面+数据集+训练代码】

在传统零售模式中,无论是大型超市还是小型便利店,结算环节往往依赖人工扫码或顾客自助扫码。这种方式不仅效率低下,容易出现排队拥堵的情况,而且在高峰时段,还可能因扫码不顺畅、设备故障等问题,让顾客的购物体验大打折扣。而智能零售柜借助商品目标检测技术,通过安装在柜内的摄像头,实时捕捉商品的图像信息,再利用先进的算法进行分析处理,瞬间就能识别出商品的种类、数量,实现快速结算,大大节省了时间。

2025-04-10 21:11:13 1393 2

原创 【论文源码实战】SMA:分割一切 第一代版本

Segment Anything Model(SAM)根据点或框等输入提示生成高质量的对象掩码,可用于为图像中的所有对象生成掩码。它已经在1100万张图像和11亿个掩模的数据集上进行了训练,并在各种分割任务上具有强大的零样本性能。

2025-04-07 09:00:00 926

原创 【论文解读】Segment Anything 分割一切大模型(附论文地址)

这是一项新的图像分割任务、模型和数据集。我们构建了迄今为止最大的分割数据集,包含超过10亿个掩码,覆盖了1100万张图像。该模型被设计和训练为可提示的(promptable),因此它能够通过提示工程零样本迁移到新的图像分布和任务。我们在众多任务上评估了它的能力,并发现它的零样本性能令人印象深刻——通常与或甚至优于以前的全监督结果。在自然语言处理(NLP)中,提示(prompt)的概念被用来指导语言模型生成特定任务的有效文本响应。

2025-04-03 09:00:00 1516

原创 【论文源码实战】Pose2Seg:无检测人体实例分割

本文介绍了一种名为Pose2Seg的新型人体实例分割框架,它不依赖于传统的目标检测方法,而是直接利用人体姿态信息来区分和分割图像中的个体。这一方法特别适用于处理人体重叠和遮挡的情况,这些情况在以往的目标检测基础上的分割方法中是一个难题。Pose2Seg框架通过一个称为Affine-Align的对齐模块,基于人体姿态而非边界框来对齐区域,从而提高了分割精度。此外,框架还融合了人工骨架特征,以增强网络对重叠人体的区分能力。为了评估这一方法,作者引入了一个新的基准数据集OCHuman,它专注于严重遮挡的人体实例,并

2025-03-20 15:35:09 1083

原创 【论文解读】Pose2Seg:无检测人体实例分割(附论文地址)

本文提出了一种基于人体姿态的实例分割框架,该框架不依赖于目标检测,而是直接基于人体姿态进行实例分割。​该框架在处理遮挡情况下的人体实例分割问题上,比现有的基于检测的方法更准确。​作者还引入了一个名为“Occluded Human (OCHuman)”的新基准数据集,专注于标注被遮挡的人体,包括边界框、人体姿态和实例掩码。​​引言研究背景与动机计算机视觉领域中与人类相关的研究日益增多,尤其是在多人姿态估计和人体实例分割方面。

2025-03-07 10:44:56 1170

原创 【论文源码实战】YOLO+3D Bounding Box:实现对目标的3D框绘制

《3D Bounding Box Estimation Using Deep Learning and Geometry》展示了如何从单一视图中恢复已知对象类别的3D边界框。通过使用新颖的MultiBin损失进行方向预测和有效地选择边界框尺寸作为回归参数,该方法能够在没有额外的3D形状模型或复杂预处理管道的情况下估计稳定且准确的3D边界框。提出了未来的研究方向,包括将立体视觉和视频序列信息整合到方法中。

2025-01-08 13:36:57 1266

YOLO V8 (Detection&Segment&Pose)batch & one.zip

YOLOv8模型,在目标检测、目标分割、关键点检测上,通过单张图片推理和多张图片同时推理,即:单张推理与批量推理。在不使用循环的情况下将多张图片的结果给推理出来。

2024-04-30

00MyPro.zip

stm32工程模板

2021-04-01

STM32F10x_StdPeriph_Lib_V3.5.0.zip

stm32的官方的固件库包

2021-03-31

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除