AI智能体应用开发
文章平均质量分 75
夏天又到了
这个作者很懒,什么都没留下…
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
第11章 智能体应用设计模式
在当前的工程范式下,智能体系统的构建重心正显著地从“底层模型能力调用”转向“上层应用逻辑编排”。这一转变意味着,尽管基础模型的推理能力构成了智能体的认知核心,但系统的最终表现往往在更大程度上取决于应用层的结构组织与运行机制。从架构设计的视角审视,智能体设计模式不仅是代码片段的复用,更是对大规模语言模型非确定性本质的一种工程化约束。本章对相关模式的梳理,并非侧重于模型内部参数的微调或训练算法的改进,而是着眼于如何在应用层面通过逻辑框架的组合,实现复杂任务的可靠解构与执行。原创 2026-09-05 18:14:16 · 37 阅读 · 0 评论 -
第10章 智能体应用参考架构
如图10-1所示,通过对不同智能体应用的分析,我们将智能体应用架构主要分成4个层级,分别为用户交互层、Agent调度层、工具执行与管理层以及存储与持久化层。这4个层级各司其职,自上而下、由表及里地构成了智能体应用的完整闭环:用户交互层捕获意图,Agebt调度层规划协调,工具执行与管理层执行动作,存储与持久化层存储记忆与知识。各个层级分工明确,保证了智能体应用的模块化和可维护性。在明确架构轮廓后,本节将逐层解析各组件的核心机制。图10-1 智能体应用架构图。原创 2026-09-05 18:01:44 · 151 阅读 · 0 评论 -
第9章 智能体应用开发流程
在智能体的开发生命周期中,首阶段的任务并非堆砌功能,而是划定认知边界与决策的自主程度。这直接决定了后续架构的选型:是做一个简单的自动化脚本,还是构建一个具备推理能力的复杂系统。在Agent开发中,最忌讳的是需求膨胀。大模型的幻觉和不确定性决定了我们必须在初期严格划定MVP(Minimum Viable Product,最小可行性产品)的范围。为了确保项目不烂尾,必须明确定义边界。MVP范围内:(1)只处理城市内配送业务,规避跨省长途的复杂路网与法规约束。原创 2026-09-05 17:53:40 · 74 阅读 · 0 评论 -
第8章 多智能体协同
随着大型语言模型等人工智能技术的快速发展,多个智能体协同工作成为可能。多智能体协同往往被视为AI从单点智能向群体智能演进的重要趋势,表明系统正朝着更高效、更灵活的方向发展。在本章中,我们将系统介绍如何让多个基于LLM的智能体通过协作来完成单一智能体难以胜任的复杂任务,并探讨支撑这一协同的技术体系。从核心概念出发,我们将分析多智能体协作的价值与应用场景,随后介绍不同的协同架构模式和关键技术,最后回顾该领域的研究前沿、业界应用示例以及常用的开源工具。通过这些内容,读者可以获得一个从理论到实践、全维度的指导框架。原创 2026-09-05 17:49:43 · 70 阅读 · 0 评论 -
7.5 其他工具生态《AI智能体应用开发》
Claude在处理用户请求时,会基于已加载的Skill元数据对任务意图进行匹配,一旦识别出合适的Skill,便从文件系统中按需加载对应的指令内容,并在必要时调用相关资源或脚本执行。虽然MCP的底层使用JSON-RPC 2.0进行通信,但它的设计初衷是高度兼容的。与传统的提示工程(Prompt Engineering)不同,后者需要在每一次交互中反复嵌入指令,而Claude的Skills机制引入了结构化、可复用、基于文件系统的能力模块,使系统能够按需加载与执行。Tools(工具):类似于“执行”操作。原创 2026-07-23 09:49:56 · 224 阅读 · 0 评论 -
7.4 工具能力实现体系《AI智能体应用开发》
注意到对于Qwen 2.5系列模型来说,生成部分并没有tool_call_id相关的内容,笔者查阅相关资料,以及vLLM的tool parser[12](Qwen2.5采用Hermes Parser)[11]后,发现id实际上是获取到大模型输出后,系统随机生成的uuid,这是为了兼容OpenAI的API格式做的工作。在本小节的剩余部分,我们会详细介绍有关请求体和响应体的部分参数,主要是和上下文传递和工具定义的参数,具体关于所有字段的含义和如何设置,可以参考OPENAI的API文档[7]。原创 2026-07-23 09:47:42 · 361 阅读 · 0 评论 -
7.3 工具类型与能力框架《AI智能体应用开发》
一个安全的数值计算工具应该使用安全的数学表达式解析库(如ast.literal_eval,或专门的库,如numexpr、sympy),严格限制可用的运算符和函数白名单,并且在沙箱环境中执行计算。在本章中,我们使用LangChain的目的在于:快速、规范地构建一个具备工具调用能力的智能体原型,并以其为标准范例,阐释工具集成的通用模式和内在原理。注意,代码执行工具风险等级更高!本章将带领读者深入智能体的“工具箱”,通过具体的、可运行的实例,拆解不同类型的工具如何被集成与调用,从而构建起一个直观的能力框架。原创 2026-07-23 09:43:44 · 160 阅读 · 0 评论 -
7.1 工具能力的定义与作用《AI智能体应用开发》
一个再“聪明”的模型,仅凭其参数内储存的静态知识和语言模式,也无法突破以下限制:一是获取实时信息,模型训练数据具有时间戳,无法知晓训练截止日期之后的事件、股价、天气等动态信息;真正的工具能力体现在智能体的元认知与决策层面:它需要知道什么时候该用工具(时机判断),从多个工具中选择最合适的一个(工具选择),以及理解如何构造有效的输入并解析返回结果(工具使用与结果解释)。要理解工具能力的核心地位,最有效的方式是对比一个不具备此能力的“纯语言模型智能体”与一个具备完善工具能力的“完整智能体”的行为模式。原创 2026-07-22 09:41:52 · 268 阅读 · 0 评论 -
7.2 工具调用的核心机制《AI智能体应用开发》
最后是行为风险,源于智能体自身决策缺陷,例如无限循环调用或对工具能力的幻觉式依赖,需要通过全局调用限制、循环检测、清晰的工具能力描述和严格的匹配逻辑来约束。这个系统如同智能体的“工具指挥中心”或“操作系统内核”,其核心职能是确保工具调用从简单的功能触发,转变为一种可管理、可观察、可扩展的系统性行为。总体而言,只有将可调度的基础设施、智能的决策规划与系统化的风险控制三者协同设计,才能把工具调用从一项高风险特权,转化为安全、稳定且可信的能力扩展。智能体将每个子任务的需求与工具描述进行匹配,选择合适的工具。原创 2026-07-22 09:43:21 · 388 阅读 · 0 评论 -
推理增强的核心路径
本节将聚焦于突破模型原生能力瓶颈的核心增强技术,着重探讨如何通过“推理时计算扩展”与“训练时能力内化”两种路径,弥补概率模型在长程逻辑与精确计算上的短板。这既不同于传统算法的确定性求解,也受限于当前的算力与数据边界,是连接模型理论潜能与工程实际应用效能的关键桥梁。前者侧重于在模型参数固定的前提下,通过延长推理时间、引入外部脚手架来换取更高的智能表现,即所谓的System 2慢思考模式;后者则致力于通过算法创新,将这种复杂的推理模式压缩进模型的神经网络权重中,使其成为一种直觉般的System 1快思考本能。6原创 2026-07-13 08:52:16 · 91 阅读 · 0 评论 -
智能体推理开发框架与工具链
这种对循环(Loop)的原生支持,使得复杂的算法(如思维树(ToT)或ReAct循环)能够被封装为可复用的工程模块,极大地降低了开发具备长程推理能力智能体的门槛。AutoGen允许开发者通过“对话编程”(Conversation Programming)的方式,定义智能体之间的交互行为,支持代码执行与人类反馈的无缝接入,从而在复杂的数学推理和编码任务中表现出优异的性能。在智能体开发中,提示词(Prompt)承载了定义推理逻辑的核心职能,但传统的手工“提示工程”存在极高的试错成本与不稳定性。原创 2026-07-13 08:53:59 · 376 阅读 · 0 评论 -
推理范式的演进
研究发现,通过在提示(Prompt)中显式地加入“让我们一步步思考”的引导,或者提供包含中间推理步骤的少样本示例(Few-shot Demonstrations),模型被强制将单步的直觉预测拆解为线性的逻辑推演链条。神经网络被视为一个巨大的“黑盒”,其推理过程是隐式的、直觉式的(类似于System 1),缺乏显式的因果推演步骤[4]。推理过程重新变得可见且可控,不仅大幅提升了数学求解与符号逻辑任务的准确率,更重要的是,它证明了逻辑推理可以作为大规模概率生成的“副产品”被激发出来,而无须专门的逻辑训练。原创 2026-07-13 08:51:22 · 188 阅读 · 0 评论 -
推理的计算本质
智能体推理能力并非生物学意义上的意识觉醒,而是指计算系统基于已知上下文信息,通过逻辑推演、因果判断或概率联想,生成新知识并指导决策的计算过程。其核心目标在于跨越“感知输入”与“行动输出”之间的语义鸿沟,使智能体不仅具备知识检索的广度,更拥有解决未见问题的深度,实现对复杂任务的自主拆解、多步执行与结果验证。这种能力是智能体区别于传统自动化脚本的根本特征,标志着机器从被动执行指令向主动规划任务的跃迁。从早期的符号逻辑到如今的生成式模型,推理能力的内涵发生了深刻的范式转移。原创 2026-07-13 08:50:11 · 269 阅读 · 0 评论 -
情感能力相关的开源软件与工具:实践形态与代表项目
在数据层面,GoEmotions以Reddit评论为素材构建27类细粒度情绪标签,并允许多标签共存,研究过程强调语境与含混性对情绪判断的影响,因此它不仅提供了可训练的数据规模,也揭示了情绪表达在自然语言中的连续性与重叠性。在输入文本中插入控制符(如[uv_break]、[laugh]、[lbreak]),可显式控制停顿、笑声与语流断开,从而实现对口语化表达的细粒度操控(2Noise, 2024[17];5-10所示以“常见工程实现的结构形态”为例,展示了编排、模型、工具、记忆、原创 2026-07-13 08:35:38 · 437 阅读 · 0 评论 -
情感能力的研究现状与趋势
情感能力的研究正在经历从理论探索到工程落地的关键转折期。本节关注情感能力的研究进展如何影响智能体落地,系统梳理哪些机制正在成为主流做法,哪些能力仍在补课,以及为什么可观察行为和可评估指标比单轮说得好听更重要。当前研究呈现出明显的分层特征。在基础能力层面,大语言模型的情感理解能力已经展现出令人瞩目的涌现特性,模型内部自发形成的情绪流形和方向性编码为可控表达提供了数学基础。然而,这种涌现能力往往是不稳定和不可控的,如何将隐性的理解转化为可观测、可评估的行为,仍然是工程实践中的核心挑战。原创 2026-07-13 08:33:52 · 233 阅读 · 0 评论 -
情感能力如何为智能体提供支撑
假使我们继续沿着“心智是什么”的抽象讨论,很容易滑向哲学或神经科学的比喻,最后变成“听起来很对,但不知道怎么做”。因此,为了让心智真正落地,本节选择一个更工程、更可操作的切入口:心智情绪计算(Affective Computing)。本节主要陈述如何将情感能力和系统在实际业务中进行落地,主要为:把情绪信号接入闭环,让情绪评估、记忆检索、用户模型更新与策略生成形成工程架构,并且可被迭代和审计复盘。赋予情感能力,不能仅靠一行提示词(Prompt),也不能只靠“把模型换大一点”。原创 2026-07-13 08:31:45 · 182 阅读 · 0 评论 -
能力定义(智能体情感能力)
设想,当你结束了一天疲惫的工作回到家,传统的智能音箱只会因红外人体感应触发事件,从而机械地播报:“现在是晚上8点,室温24度,灯已打开。”而一个具备心智的智能体可能会继续确认你的状态:“听起来你今天很累—你希望我帮你做点什么:放首音乐放松一下,还是先理清明天的待办?”这类“既接住情绪,又推进任务”的能力,往往决定了用户是否愿意信赖该系统,甚至是把它当作长期助手。无论用户是在使用传统软件程序还是智能体协作完成任务,都难以做到每一次交互都能顺利、完美地完成,因此在实际过程中常常难免会出现情绪波动。原创 2026-07-13 08:25:45 · 290 阅读 · 0 评论 -
智能体的其他模态感知能力
智能体的环境感知能力已经从早期的单一模态处理发展到当前的多模态融合理解阶段。除了传统的文本感知外,音频、图片和视频作为三大关键模态,极大地扩展了智能体对现实世界的理解维度,使智能体能够更全面地理解物理世界,支撑从消费级应用到工业级场景的广泛落地[15]。这些模态各自携带独特信息:音频提供时序和事件线索,图像蕴含空间和视觉特征,视频则整合了时空动态关系。多模态感知的融合使智能体能够构建统一的环境表征,为后续的认知决策提供坚实基础。本节将深入探讨智能体在音频、图片和视频感知方面的关键技术、实现方法与应用场景。原创 2026-07-11 10:45:50 · 294 阅读 · 0 评论 -
开源技术栈选型
更重要的是,Chroma允许用户为向量绑定丰富的元数据,例如{"source": "user_manual", "chapter": "3"},并支持在检索时进行混合查询(Hybrid Search),即同时满足语义相似与元数据匹配两个条件。FAISS是目前工业界公认的标准答案,特别是在处理十亿级向量的场景下,其性能表现几乎是业界的标杆。与通用的编排框架不同,LlamaIndex的核心哲学是“数据为先”,它极度关注如何将私有数据构建成高质量的索引结构,以便LLM能够高效地通过查询与数据交互。原创 2026-07-12 10:59:31 · 98 阅读 · 0 评论 -
知识赋能(4.4节)
大模型凭借其独特的架构和训练方式,展现出与传统模型截然不同的特性,这些特性既赋予了它们强大的能力,也带来了一定的局限性。原创 2026-07-12 10:53:56 · 119 阅读 · 0 评论 -
知识管理(4.2节)
4.1节介绍了智能体知识的理论基础,本节将把视角推进到工程实现的核心—知识管理。在智能体系统中,知识不是一次性导入的静态数据,而是一个需要被持续获取、优化、服务与治理的动态体系。如何构建一套稳定、高效的知识管理体系,是智能体能否从可用走向可靠的关键。本节将围绕智能体知识管理这一核心概念展开,构建从知识获取、数据预处理、质量评估到存储建模的闭环架构,知识管理框架如图4-3所示。我们将重点关注智能体知识如何在不同阶段被转换、检索与调度,以及这些工程决策如何直接影响智能体的响应质量与系统稳定性。原创 2026-07-12 10:52:24 · 210 阅读 · 0 评论 -
知识的定义与内涵
知识是智能体跨越单纯的语言交互、迈向高阶认知决策的核心要素。其核心在于构建物理世界与数字空间的语义映射,将无序的原始输入转化为可被智能体理解、推理并指导行动的结构化信息。通过整合内隐的模型参数与外显的知识库,知识体系为智能体在复杂动态环境中进行感知理解、逻辑推演及任务规划提供了根本性的认知保障。原创 2026-07-12 10:47:07 · 198 阅读 · 0 评论 -
智能体记忆开源框架、工具与评估指标
随着智能体记忆研究从概念验证阶段逐步走向规模化落地应用,工程实践逐渐形成了一套围绕记忆管理、存储基础设施与评估机制的完善开源技术生态。与早期仅关注向量存储不同,当前的系统设计已明显呈现出三个演进方向:记忆编排的系统化、存储结构的混合化以及能力评估的自动化。这一变化表明,智能体记忆已不再被视为某个单一算法模块,而是逐步演化为一类需要操作系统式管理与持续观测的工程能力。本节将从工程分工的角度,梳理支撑智能体记忆能力高效落地的关键软件框架与评估方法。原创 2026-07-12 10:36:31 · 168 阅读 · 0 评论 -
智能体三层记忆参考框架
当智能体需要处理海量知识或具备无限生命周期时,则需要外挂知识库或记忆库。如图3-3所示为通过Letta框架搭建的电商客服机器人问答流程示例。图3-3 通过Letta框架搭建的电商客服机器人问答流程示例在此阶段,工作记忆仅保留当前意图,海量历史被卸载至独立的外部存储设施(如向量数据库)。系统将历史交互进行切片、向量化并持久化存储,构建起物理分离的“长期记忆层”。原创 2026-07-12 10:34:33 · 395 阅读 · 0 评论 -
记忆支撑与技术演进
在完成形式化定义后,本节将视角从“记忆是什么”转向“记忆如何工作”,探讨记忆能力在技术层面如何驱动智能体的复杂行为,并梳理现有研究中记忆建模范式的演进逻辑。在LLM参数固定(Frozen Weights)的约束条件下,记忆系统的核心技术价值在于提供了一种可读写、可更新的外部状态空间。这使得智能体无须高昂的微调成本,即可获得近似“在线学习”与环境持续适应的能力[9]。原创 2026-07-12 10:24:48 · 183 阅读 · 0 评论 -
记忆能力的定义与内涵
为了在计算层面明确记忆在智能体系统中的角色,有必要超越“历史缓存”或“数据库”的直观隐喻,从认知心理学的动态过程出发,将其抽象为可描述、可计算的工程模型。原创 2026-07-12 10:20:19 · 217 阅读 · 0 评论 -
智能体的特点
智能体之所以在人工智能领域备受瞩目,成为推动科技进步与创新的关键力量,得益于其独具的四大核心特点:自主性、适应性、学习能力和交互性。这些特点相互交织、协同赋能,既构建了智能体的核心能力体系,又赋予其强大的场景适配性与应用拓展潜力,使其能够在复杂多变的环境中灵活应对不确定性,高效完成多样化任务,为人类生产生活的智能化变革提供核心支撑[9]。原创 2026-07-10 13:07:01 · 308 阅读 · 0 评论 -
鲍亮垂直Agent开发入门书《AI智能体应用开发》全文试读~
本章聚焦智能体感知能力这一核心主题,从整体架构视角出发,系统阐述感知能力在智能体体系中的定位与作用机制,并以文档感知为重点,深入拆解文档预处理的关键任务、输出形态及主流技术工具。发展历程的梳理显示,智能体从20世纪中叶的理论萌芽起步,历经符号主义主导的奠基期、连接主义推动的黄金期、强化学习与深度学习融合的复兴期,在大数据与大模型的加持下进入爆发期,每一步演进都离不开技术突破的支撑。本章围绕智能体基础展开,系统梳理了智能体的核心概念、发展历程、核心特点及应用挑战,为读者构建了智能体认知的基础框架。原创 2026-07-10 13:12:13 · 512 阅读 · 0 评论 -
智能体应用的挑战
尽管智能体技术展现出巨大的潜力和广阔的应用前景,在金融、交通、医疗等多个领域实现了初步落地,但在规模化推广与深度应用过程中,仍面临技术、伦理、安全及开发生态等多重交织的挑战。这些挑战并非孤立存在,而是相互关联、相互制约,既涉及底层技术的固有局限,也涵盖产业生态与社会认知的现实壁垒,成为阻碍智能体从“实验室走向产业化”的核心障碍。唯有系统性破解这些难题,才能推动智能体技术真正实现从理论突破到实践赋能的跨越,为人类社会生产生活的智能化变革提供可持续支撑[1]。原创 2026-07-10 13:08:22 · 171 阅读 · 0 评论 -
智能体发展历史
智能体的发展并非一蹴而就,而是经历了漫长的演进过程,其脉络与人工智能整体演进高度契合,本质是技术范式迭代、核心算法突破与应用需求驱动的双向奔赴。从早期规则编码到如今大模型赋能,每个阶段的标志性算法都以可量化的公式为支撑,推动智能体能力边界持续拓展。结合核心技术路线、算法突破与能力边界变化,可将智能体发展划分为4个关键阶段,每个阶段的理论突破与技术成果,都为后续的跨越式发展奠定了坚实基础[4]。原创 2026-07-10 13:04:42 · 214 阅读 · 0 评论 -
智能体基础
在人工智能的宏大版图中,智能体(Agent)占据着举足轻重的基础地位,宛如一座大厦的基石,支撑起整个智能应用的摩天大楼。国际人工智能领域权威学者罗素(Stuart J. Russell)与诺维格(Peter Norvig)在经典著作《人工智能:一种现代的方法》中,给出了具有奠基性的界定:智能体是“能够感知环境并通过行动影响环境的实体”[1],这一定义为后续学界与产业界的认知演进奠定了核心框架。原创 2026-07-10 12:53:34 · 211 阅读 · 0 评论 -
【图书预告】《AI智能体应用开发》
本书作者为鲍亮、崔江涛、李倩和范涛。第四部分是AI智能体应用开发案例(第12~16章),主要介绍垂直场景智能体项目的需求分析、系统架构、关键技术与工程落地方法,包括深度研究智能体、数据分析智能体、数据科学智能体、决策优化智能体、机器视觉智能体等5个实际案例。原创 2026-06-03 12:02:06 · 616 阅读 · 0 评论
分享