- 博客(179)
- 资源 (2)
- 收藏
- 关注
原创 工具依赖关系处理:让 Agent 学会“chaining“
当工具之间存在依赖关系——Tool B 需要 Tool A 的输出作为输入——Agent 该如何处理?本文介绍四种策略:ReAct 多步推理、LangGraph StateGraph、LCEL 链式组合和复合工具封装,帮你彻底解决工具依赖链的数据传递问题。
2026-08-08 08:00:00
619
原创 避免相似工具混淆:让 Agent 不再“选错门“
当 Agent 拥有多个功能相似的工具时,很容易"选错门"——把网页搜索当成知识库检索,把摄氏度转换当成华氏度转换。本文总结了 5 种实用策略:命名区分、正反场景描述、参数差异化、系统提示词引导、中间件路由,帮助你让 Agent 精准选择正确的工具。
2026-08-06 15:06:41
328
原创 何时拒绝使用工具:Agent 不是万能钥匙
Agent 的核心能力之一是调用工具,但"有能力调用"不等于"应该调用"。本文探讨 Agent 何时应该拒绝使用工具,以及如何通过 System Prompt、工具描述和条件边来引导 Agent 做出正确判断。
2026-07-23 15:23:50
161
原创 生产级异步工具:用 async def 打造高性能 Agent
当 Agent 需要调用外部 API、查询数据库时,同步工具会阻塞整个事件循环。本文教你用 async def 编写生产级异步工具,实现并发执行、结构化错误处理和优雅降级,让 Agent 性能提升数倍。
2026-07-15 15:04:23
150
原创 工具错误处理:让 Agent 优雅应对每一次失败
工具错误处理的核心不是"避免错误",而是"让 Agent 看到错误"。不抛异常、返回错误信息、实现重试,让 Agent 具备自修正能力。
2026-07-09 15:49:48
377
原创 工具命名与描述:让 Agent 精准调用的一线生机
工具命名和描述是影响 Agent 工具调用准确率的关键。好的命名让工具自解释,好的描述让模型知道何时用、何时不用。
2026-07-06 01:50:45
163
原创 Agent 工具开发:Pydantic 模型使用指南
掌握使用 Pydantic BaseModel 定义复杂工具参数Schema,实现嵌套结构、字段验证和类型安全。
2026-06-29 14:54:47
194
原创 LangChain 如何让 AI 自动理解你的函数?JSON Schema 自动生成详解
本文深入解析 @tool 装饰器如何通过 Python 反射和 Pydantic 动态模型,将函数签名自动转换为标准 JSON Schema,让 AI 能够准确理解工具的参数结构。
2026-06-11 21:02:51
232
原创 LangChain @tool 装饰器:让函数秒变 Agent 工具
本文深入解析 LangChain 的 @tool装饰器,探讨如何通过最少的样板代码将普通 Python 函数转换为 Agent 可调用的智能工具,以及如何设计高质量的工具描述和错误处理机制。
2026-05-29 20:42:44
284
原创 Tool Calling 深度实践:四种模式与并行调用的完整指南
深入掌握 Tool Calling 的 tool_choice 四种模式(auto/any/具体工具名/disabled)、.bind_tools() 绑定语法和 parallel_tool_call 并行调用机制,让你的 Agent 更高效、更可控地调用外部工具。
2026-05-26 14:20:29
446
原创 Function Calling 实战:让 LLM 拥有调用外部工具的能力
通过工具注册、模型决策、工具执行和结果整合四步流程,让大语言模型能够调用外部工具,突破知识限制,实现实时数据查询和业务系统集成。
2026-05-21 15:14:39
427
原创 结构化输出实战:用 Pydantic + Function Calling 让 LLM 返回可靠数据
结合 Pydantic 数据验证、JSON 格式控制和函数调用,掌握 with_structured_output() 高级 API 和手动 Chain 构建两种方案,构建可靠的 AI 结构化输出系统。
2026-05-20 16:28:24
385
原创 国产大模型 API 封装:一套接口调用智谱、通义千问等国产模型
通过抽象基类 BaseModelClient 统一不同厂商的 SDK 接口,实现异步聊天调用、费用计算和智能路由推荐,让国产大模型调用像调用统一服务一样简单。
2026-05-17 13:25:13
520
原创 多模型 API 调用:一套代码同时调用 GPT、Claude 等大模型
通过构建 MultiModelComparator 架构,抽象不同厂商 SDK 差异,实现并发调用多个大模型并对比响应内容、延迟和 Token 消耗。
2026-05-16 15:00:19
453
原创 Chain-of-Thought Prompting:让 AI “说出思考过程“的推理魔法
Chain-of-Thought(思维链)提示通过让模型展示推理过程,将隐式的多步计算转化为显式的序列生成,显著提高数学、逻辑等复杂推理任务的准确性。
2026-05-15 14:46:15
536
原创 Multi-Head Attention:让 AI 拥有“多个大脑“同时思考
Multi-Head Attention(多头注意力)通过将注意力分成多个并行子空间,让模型能同时捕获语法、语义、长距离等不同类型的关系,是 Transformer 表达能力的关键。
2026-05-14 11:27:25
409
原创 Self-Attention 机制:让 AI 真正理解上下文的“核心引擎“
Self-Attention(自注意力)是 Transformer 的"心脏",它通过 QKV 机制让序列中的每个词都能与其他词直接"对话",彻底解决了 RNN 的长遗忘问题。
2026-05-13 10:49:36
218
原创 Transformer 架构:大语言模型的“心脏“
Transformer 是 ChatGPT、Claude 等所有大语言模型的基础架构。它通过"自注意力"机制解决了 RNN 的长遗忘问题,让 AI 真正能理解长文本。
2026-05-12 13:54:30
957
原创 LCEL 管道编程:理解数据如何在 AI 组件间流动
LCEL 的核心是 Runnable 协议——所有 AI 组件共享同一套接口。掌握数据流转和类型匹配,你就能像搭积木一样构建任意复杂的 AI 工作流。
2026-05-11 16:32:46
532
原创 LangChain LCEL:用管道符串联你的 AI 工作流
LCEL 是 LangChain 的表达式语言,通过管道符 `|` 将多个 AI 组件串联成数据流水线,让复杂的工作流定义变得像搭积木一样简单。
2026-05-10 17:55:41
343
原创 Skill、MCP 与 Tool:AI 的三种“动手“方式
Skill、MCP 和 Tool 调用是 AI 应用开发中的三种核心技术,分别解决了"做什么"、"如何连"和"如何调"三个层面的问题。理解它们的区别,才能构建高效的 AI 系统。
2026-05-09 15:07:11
449
原创 一文读懂 Temperature 参数:AI 的“创意旋钮“
Temperature(温度)是控制 AI 输出确定性与多样性的核心参数,就像调节创意的"旋钮"——低温稳定可靠,高温充满想象。
2026-05-07 15:01:17
435
原创 JSON 格式输出控制:如何让 AI 每次都返回完美的结构化数据?
大模型天生不擅长输出严格的 JSON 格式。本文教你如何通过 Schema 验证、自动修复和提示工程,确保 AI 每次都返回合法、可用的结构化数据。
2026-05-06 14:49:38
233
原创 少样本提示(Few-shot Prompting):为什么给 AI 几个例子就能让它变聪明?
Few-shot Prompting 通过给模型提供少量示例,让它快速理解任务格式和映射规则。
2026-05-05 19:09:08
481
原创 零样本提示(Zero-shot Prompting):为什么 AI 能听懂你没教过的事?
Zero-shot Prompting 是一种让 AI 模型在没有示例的情况下,仅通过指令就能完成任务的技术
2026-05-04 13:31:26
394
原创 【YOLO 系列】基于YOLO的车载摄像头道路标志和车辆目标检测识别系统【python源码+Pyqt5界面+数据集+训练代码】
在传统的交通管理和智能驾驶领域,道路标志和车辆的检测通常依赖人工观察或传统的计算机视觉方法,这种方式不仅效率低下,容易出现漏检和误检的情况,而且在复杂的路况和恶劣的天气条件下,检测的准确性和实时性难以保证。而基于 YOLO 的道路标志和车辆目标检测系统,通过安装在车辆或道路监控设备上的摄像头,实时捕捉道路的图像信息,再利用先进的算法进行分析处理,能够快速、准确地识别出道路标志和车辆的位置和类型,从而实现自动化检测,大大节省了时间和人力成本。
2025-06-14 11:28:50
1443
原创 【YOLO 系列】基于YOLO的飞机表面缺陷智能检测系统【python源码+Pyqt5界面+数据集+训练代码】
本文介绍了基于YOLOv8的飞机表面缺陷智能检测系统,该系统通过深度学习技术实现了飞机表面缺陷(如裂纹、凹陷等)的自动化检测,显著提升了检测效率和准确性。系统采用PyQt5搭建可视化界面,支持图片、视频及摄像头的实时检测,并具备结果保存功能。文章详细阐述了环境搭建、算法原理(包括改进的C3K2和C2PSA模块)、数据集准备(1250张标注图片)、模型训练与评估过程,以及推理应用效果。该系统具有高准确性、实时性和鲁棒性,可广泛应用于航空安全监控、飞机维护等领域。完整代码和资源文件已打包提供下载。
2025-06-05 18:57:21
1616
原创 【目标检测数据集】电动车驾驶员戴头盔相关数据集
摘要:本文介绍了两个电动车头盔检测数据集:1) TWHD数据集包含5026张图片,标注了15348个戴头盔、7876个未戴头盔和16759个双轮车目标;2) 国内道路数据集包含5255张图片,标注了4926个戴头盔、4221个未戴头盔和8158个双轮车目标。两个数据集均包含三类标注(头盔/未戴头盔/双轮车),数据来源包括开源数据集和网络爬取图像,可用于电动车头盔检测算法开发。
2025-06-02 11:57:57
1243
1
原创 【论文解读】CVPR2023 PoseFormerV2:3D人体姿态估计(附论文地址)
PoseFormerV2,通过探索频率域来提高 3D 人体姿态估计的效率和鲁棒性。PoseFormerV2 利用离散余弦变换(DCT)将骨骼序列转换为低频系数,显著减少了计算量并提高了对噪声的抵抗力。
2025-05-30 11:14:41
2030
原创 【YOLO 系列】基于YOLO的道路坑洞检测识别系统【python源码+Pyqt5界面+数据集+训练代码】
本文介绍了一种基于YOLO模型的道路坑洞检测系统,旨在提高道路维护的效率和安全性。系统采用Pyqt5库搭建用户界面,支持图片、视频和摄像头的检测,并能保存检测结果。通过本项目,期望为道路维护和管理提供技术支持,推动智能交通和城市管理的智能化升级。
2025-05-15 18:24:01
1009
原创 【YOLO 系列】基于YOLO的涡轮机叶片(风机扇叶)缺陷检测系统【python源码+Pyqt5界面+数据集+训练代码】
在现代工业生产中,涡轮机叶片(风机扇叶)的缺陷检测是确保设备安全运行和高效生产的关键环节。传统的检测方法通常依赖人工目检,这种方式不仅效率低下,容易出现漏检和误检的情况,而且在高强度的工作环境下,检测人员的疲劳也可能导致检测质量下降。而基于 YOLO 的涡轮机叶片缺陷检测系统,通过安装在设备周围的摄像头,实时捕捉叶片的图像信息,再利用先进的算法进行分析处理,能够快速、准确地识别出叶片的缺陷类型和位置,从而实现自动化检测,大大节省了时间和人力成本。
2025-04-11 09:45:00
2449
原创 【YOLO 系列】基于YOLO的智能零售柜商品检测系统【python源码+Pyqt5界面+数据集+训练代码】
在传统零售模式中,无论是大型超市还是小型便利店,结算环节往往依赖人工扫码或顾客自助扫码。这种方式不仅效率低下,容易出现排队拥堵的情况,而且在高峰时段,还可能因扫码不顺畅、设备故障等问题,让顾客的购物体验大打折扣。而智能零售柜借助商品目标检测技术,通过安装在柜内的摄像头,实时捕捉商品的图像信息,再利用先进的算法进行分析处理,瞬间就能识别出商品的种类、数量,实现快速结算,大大节省了时间。
2025-04-10 21:11:13
1393
2
原创 【论文源码实战】SMA:分割一切 第一代版本
Segment Anything Model(SAM)根据点或框等输入提示生成高质量的对象掩码,可用于为图像中的所有对象生成掩码。它已经在1100万张图像和11亿个掩模的数据集上进行了训练,并在各种分割任务上具有强大的零样本性能。
2025-04-07 09:00:00
926
原创 【论文解读】Segment Anything 分割一切大模型(附论文地址)
这是一项新的图像分割任务、模型和数据集。我们构建了迄今为止最大的分割数据集,包含超过10亿个掩码,覆盖了1100万张图像。该模型被设计和训练为可提示的(promptable),因此它能够通过提示工程零样本迁移到新的图像分布和任务。我们在众多任务上评估了它的能力,并发现它的零样本性能令人印象深刻——通常与或甚至优于以前的全监督结果。在自然语言处理(NLP)中,提示(prompt)的概念被用来指导语言模型生成特定任务的有效文本响应。
2025-04-03 09:00:00
1516
原创 【论文源码实战】Pose2Seg:无检测人体实例分割
本文介绍了一种名为Pose2Seg的新型人体实例分割框架,它不依赖于传统的目标检测方法,而是直接利用人体姿态信息来区分和分割图像中的个体。这一方法特别适用于处理人体重叠和遮挡的情况,这些情况在以往的目标检测基础上的分割方法中是一个难题。Pose2Seg框架通过一个称为Affine-Align的对齐模块,基于人体姿态而非边界框来对齐区域,从而提高了分割精度。此外,框架还融合了人工骨架特征,以增强网络对重叠人体的区分能力。为了评估这一方法,作者引入了一个新的基准数据集OCHuman,它专注于严重遮挡的人体实例,并
2025-03-20 15:35:09
1083
原创 【论文解读】Pose2Seg:无检测人体实例分割(附论文地址)
本文提出了一种基于人体姿态的实例分割框架,该框架不依赖于目标检测,而是直接基于人体姿态进行实例分割。该框架在处理遮挡情况下的人体实例分割问题上,比现有的基于检测的方法更准确。作者还引入了一个名为“Occluded Human (OCHuman)”的新基准数据集,专注于标注被遮挡的人体,包括边界框、人体姿态和实例掩码。引言研究背景与动机计算机视觉领域中与人类相关的研究日益增多,尤其是在多人姿态估计和人体实例分割方面。
2025-03-07 10:44:56
1170
原创 【论文源码实战】YOLO+3D Bounding Box:实现对目标的3D框绘制
《3D Bounding Box Estimation Using Deep Learning and Geometry》展示了如何从单一视图中恢复已知对象类别的3D边界框。通过使用新颖的MultiBin损失进行方向预测和有效地选择边界框尺寸作为回归参数,该方法能够在没有额外的3D形状模型或复杂预处理管道的情况下估计稳定且准确的3D边界框。提出了未来的研究方向,包括将立体视觉和视频序列信息整合到方法中。
2025-01-08 13:36:57
1266
YOLO V8 (Detection&Segment&Pose)batch & one.zip
2024-04-30
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅