- 博客(3277)
- 收藏
- 关注
原创 从 DAG 到循环图:LangGraph 如何突破传统工作流引擎的限制
问题1:状态管理:如何处理任务间的依赖数据传递?如何支持任务的回溯与重试?问题2:流程控制:如何定义任务的执行顺序?如何处理条件分支、并行执行、异常处理?问题3:可观测性与调试性:如何追踪工作流的执行路径?如何定位任务失败的原因?状态(State):类型化的、可继承的、可自定义合并的全局数据结构节点(Node):无副作用的纯函数(或封装了副作用的「伪纯函数」),接收当前状态,返回状态更新边(Edge):定义节点间的执行顺序的有向连接,支持「无条件边」「条件边」「终点边」三种类型。
2026-06-14 20:56:59
120
原创 为语音 Agent 设计 Harness 实时音频流控制
你有没有过这样的场景:深夜赶方案熬到喉咙冒烟,对着桌上的智能音箱喊“播放一首能提神的爵士”,3秒后音箱才慢悠悠传来“正在为您搜索能提神的爵士”,再过2秒播放的居然是摇篮曲;或者线上会议对着虚拟参会助手(比如嵌入Zoom的语音Agent)提问“刚才张总监提到的项目Q3 ROI目标是多少?”,助手先是突然静音1秒,再把整个前10分钟的会议录音断断续续读了一遍,最后才蹦出一句“抱歉,刚才没听清您的问题”。
2026-06-14 20:00:41
219
原创 Agent记忆持久化的七种工程实现方案
本章我们从人类记忆的类比出发,引出了Agent记忆持久化的核心概念,分析了LLM驱动Agent“失忆”的问题背景与核心四维问题,介绍了业界和学术界探索出的七种成熟工程实现方案,明确了Agent记忆持久化的边界与外延。接下来的章节,我们将逐一详细介绍这七种方案,从基础层的直观理解,到深度层的原理机制与数学模型,再到整合层的项目实践与最佳实践,帮助读者全面掌握Agent记忆持久化的工程技术。,无法记住上次交互的细节、完成的任务、积累的经验,更别说形成“长期人格”或“跨Agent协作的知识沉淀”。
2026-06-14 19:09:32
192
原创 AI Agent Harness Engineering 的 Prompt Engineering 新范式
如果将2022年底ChatGPT的发布比作“AI新时代的点火仪式”,那么2023年则是AI Agent元年:OpenAI推出的GPT-4 Tools让大模型首次具备“按需调用外部插件”的能力;微软Azure OpenAI Studio上线了完整的Agent Studio开发套件;字节跳动的豆包Pro、Meta的Llama 3-in-One Agent、Anthropic的Claude Pro Code Interpreter也纷纷切入自主协作场景。根据Gartner 2024年技术成熟度曲线,
2026-06-14 02:06:35
204
原创 Harness 中的智能预加载:基于页面访问模式
凌晨3点27分,旧金山一家金融科技公司的运维监控大屏突然亮起刺眼的红色——,用户投诉量在这段时间内飙升到平时的12倍,CTO正在连夜电话轰炸DevOps负责人李工。
2026-06-14 01:15:27
204
原创 多智能体消息协议设计:字段、优先级、追踪ID、重试语义怎么定
当100台工业机器人在同一条柔性生产线同步协作、当200架植保无人机在10万亩农田编队喷洒、当1000辆自动驾驶汽车在城市主干道共享路况信息时,。今天,我们就站在「多智能体系统协作的神经中枢」位置,从到,从到,从到,彻底搞懂这四个最核心也最容易踩坑的协议要素——字段、优先级、追踪ID、重试语义——到底该怎么定。
2026-06-14 00:14:06
149
原创 基于 Kademlia 的 Harness 点对点路由
Kademlia 是 2002 年由 Petar Maymounkov 和 David Mazières 在《Kademlia: A Peer-to-Peer Information System Based on the XOR Metric》论文中提出的。Olog2bNb。
2026-06-13 23:22:55
95
原创 智能体评估基准(AgentBench)解读:我们如何衡量AI Agent的智能?
如果我能测量它,我就能改进它。”——开尔文勋爵的这句名言,放在AI Agent时代同样是黄金准则。从ChatGPT的“通用对话工具”到AutoGPT的“自主任务执行者”,再到GPT-4o的“多模态、实时反馈Agent雏形”,AI系统的能力边界正在从“回答单一问题”向“完成复杂、多步骤、多约束的真实世界任务”快速扩张。但与此同时,一个非常尴尬但又迫在眉睫的问题我们到底该用什么标准,来公平、客观、全面地衡量一个AI Agent的“真实智能水平”?
2026-06-13 22:21:35
68
原创 生产环境Agent成本失控?精细化Token消耗分析与混合模型调度指南
传统的Agent成本控制思路是「被动止损」——如设置月度总Token预算、设置单用户单会话Token上限、手动缩减Prompt指令长度,但这些方法往往会牺牲用户体验(如预算耗尽后Agent无法使用、单会话Token上限导致对话中断、Prompt指令缩减导致推理准确率下降)。某电商智能客服Agent部署初期(2024年Q1),月度Token成本为$12k;2024年Q2部署了「多模态退换货凭证审核」「多轮情感安抚」功能后,月度Token成本飙升至$97k,但同时期用户会话量仅增长了23%;
2026-06-13 21:25:17
206
原创 LangGraph 插件开发教程:打造专属多智能体工具的全流程
总结参考资料附录17.1 完整的项目代码仓库链接17.2 完整的文件17.3 完整的文件17.4 完整的测试用例代码17.5 文章中提到的所有图表的源文件。
2026-06-13 20:24:11
163
原创 Agent 安全性红队测试:如何防止 Prompt Injection 攻击你的智能体?
从软件工程的可信系统三角(Confidentiality, Integrity, Availability, CIA+)可信智能体(Trusted Agent):指能够严格遵循开发者预设的「目标意图(Goal Intent)」和「行为约束(Behavioral Constraints)」执行任务,不受未授权外部/内部提示影响,且在所有输出、API 调用、数据流转中保持 CIA+ 属性的 LLM-工具链组合。我们可以从攻击者的能力攻击的触发方式攻击的层级深度攻击的目标。
2026-06-13 19:22:32
188
原创 AI Agent Harness Engineering 农业应用案例:精准种植、病虫害识别与产量预测
遥感卫星/无人机普及:截至2023年底,中国民用无人机保有量突破1000万架,农业专用无人机保有量超20万架,能覆盖全国1/3以上的规模耕地;土壤/气象传感器遍地开花:全国已建成超过5万个农业气象站、12万个土壤墒情监测点,部分规模农场的传感器密度甚至达到了每10亩1个;单点AI模型爆发。
2026-06-13 02:19:35
245
原创 案例分析:学术文献综述 Agent Harness
学术综述任务可形式化为一个多阶段、多目标、约束优化的序列决策问题设综述需求为RDTLFCR⟨DTLFC⟩DDD:综述的研究领域(如「多模态大模型医疗健康应用」);TTT:综述的研究时间范围(如「2022-01-01至2025-06-30」);LLL:综述的语言(如「中文」、「英文」);FFF:综述的格式规范(如「APA 7th」、「MLA 9th」、「GB/T 7714-2015顺序编码制」);CCC。
2026-06-13 01:18:13
206
原创 AI Agent Harness Engineering 开发效率工具:Prompt工程、调试与监控平台
本文将分为以下十个主要章节摘要/引言(本章):介绍本文的核心概念、问题背景、问题陈述、核心价值和文章概述;行业发展与未来趋势:梳理AI Agent、Prompt工程、LLM原生应用调试与监控的发展历史,分析当前的技术现状和未来的发展趋势;概念结构与核心要素组成:详细拆解AI Agent Harness、Prompt工程工业化套件、全链路LLM原生应用调试与监控平台的概念结构和核心要素组成;概念之间的关系。
2026-06-13 00:21:57
208
原创 AI Agent Harness Engineering 在供应链管理中的智能优化
回顾要点:AI Agent Harness的核心价值、极简多Agent供应链系统的搭建步骤、LangGraph的核心用法成果展示:演示我们刚才搭的Streamlit系统能解决什么问题(比如把爆品的缺货率从假设的30%降到5%,把冷门SKU的库存周转率提高20%)鼓励与展望。
2026-06-12 23:25:43
49
原创 AI Agent Harness Engineering 如何整合内部 ERP _ CRM _ BI 并自动执行任务
为了帮助读者真正理解并落地AI Agent Harness Engineering整合ERP/CRM/BI并自动执行任务,本文将采用**“理论讲解+实战演示+最佳实践+行业趋势”的结构,从零开始,带你搭建一套概念篇(第三、四章)第三章将深入讲解。
2026-06-12 22:34:32
181
原创 AI Agent Harness Engineering + RPA:自动化办公的终极解决方案,效率提升 300%
1990-2010年:传统OA阶段,核心是把线下流程搬到线上,解决了流程线上化的问题,但所有决策和操作仍需人工完成,效率提升仅约10%;2010-2023年:传统RPA阶段,通过UI模拟、API对接实现固定规则的自动化执行,解决了结构化、高重复流程的操作问题,但仅能覆盖企业不到20%的办公场景,效率提升上限约30%;
2026-06-12 20:36:55
187
原创 提示词工程标准化文档编写指南
本指南旨在为企业、团队乃至个人开发者提供一套可落地、可复用、可扩展的提示词工程标准化文档编写框架。标准化文档的核心结构模块(需求背景、目标描述、角色设定、上下文约束、输出规范、验证指标、迭代日志、版本控制、复用指南9个强制模块,以及性能优化、安全提示、多语言适配3个可选模块);每个模块的详细编写规范(包括语言风格、必填项/选填项、避免的坑、优秀示例/反例对比);文档编写的配套流程(需求分析→初稿编写→模型适配测试→多场景验证→内部评审→正式发布→迭代维护);提示词的版本控制与知识库集成方案。
2026-06-12 19:40:40
124
原创 AI Agent Harness Engineering 产品定价策略:按 Token、调用次数还是效果付费?一文算清经济账
开发层:低代码工具编排、Prompt工程、RAG知识库管理、多模态能力接入运行层:推理路由、记忆管理、规划引擎、安全合规管控运营层:可观测性、效果评估、A/B测试、成本管控简单来说,Agent Harness就是AI Agent时代的「云服务商」:你不需要自己搭服务器、装运维工具,只需要聚焦业务逻辑,底层能力全部由Harness提供,你为使用的资源付费。定价模式核心计费逻辑核心优势核心劣势按Token付费按大模型推理消耗的输入/输出Token量计费,通常以千Token为单位。
2026-06-12 02:47:55
328
原创 速率限制与配额控制:Harness层的流量治理
本文将从核心概念、原理算法、架构设计、代码实现、落地实践多个维度,完整讲解Harness层如何实现工业级的速率限制与配额控制。我们会从0到1搭建一套可直接用于生产环境的Harness层流量管控体系,包含分布式限流算法实现、多维度配额管理、规则动态生效、监控告警全链路能力。Harness层又被称为流量管控层、服务编排层,是介于API网关和业务微服务之间的中间层,负责统一实现所有横切关注点:流量管控、身份鉴权、参数校验、服务编排、熔断降级、监控埋点等能力,避免每个业务服务重复实现相同逻辑。限流层级。
2026-06-12 01:51:39
252
原创 AI Agent在供应链管理中的智能决策
AI Agent是指具备感知能力、记忆能力、推理能力、行动能力、通信能力的自主智能实体,能够在没有人工干预的情况下,根据环境输入自主完成特定目标的决策和执行。和传统AI模型相比,AI Agent最大的特点是具备自主性、迭代性和协同性:不需要每次都人工输入特征和调用模型,能够自主感知环境变化、沉淀经验、迭代模型,还能和其他Agent协同完成复杂任务。"""自定义供应链库存优化环境"""# 环境参数self.max_stock = max_stock # 最大库存。
2026-06-12 00:50:19
151
原创 企业数据如何赋能AI Agent
结构化数据:CRM、ERP、OA、财务系统中的表单数据,比如客户信息、订单信息、员工信息非结构化数据:客服对话记录、产品文档、维修手册、合同、会议纪要、监控视频/音频半结构化数据:业务日志、API请求日志、JSON格式的业务数据按照敏感等级可以分为:公开数据、内部数据、敏感数据、机密数据四个等级。
2026-06-11 23:54:00
89
原创 AI Agent Harness自动化运维平台搭建
概念通俗解释核心作用AI Agent拥有感知、决策、记忆、工具调用能力的大模型驱动智能体,相当于运维团队的“智能班长”接收告警、根因分析、生成处理方案、判断是否需要人工介入Harness全球领先的一体化DevOps平台,内置CI/CD、故障自愈、混沌工程、云成本管理等全栈编排能力,相当于运维团队的“执行士兵”把AI Agent生成的方案转化为可执行的自动化流程,兼容所有主流云、容器、中间件工具AIOps 2.0。
2026-06-11 23:02:52
101
原创 用延迟直方图驱动 Harness 的自动扩缩容
本文将带你从原理到实战,完整搭建一套「延迟直方图驱动 + Harness 智能决策」的Kubernetes自动扩缩容体系。我们会从延迟直方图的核心原理讲起,一步步教你完成服务埋点、Prometheus指标采集、Harness弹性策略配置、ML智能阈值优化、扩缩容效果校验全流程,所有代码和配置都可以直接复用。传统的延迟指标都是聚合后的值,比如平均延迟是把所有请求的延迟加起来除以请求数,P95延迟是把所有请求延迟排序后取95%分位的值,这些指标都会丢失原始的延迟分布信息,无法准确反映用户体验。
2026-06-11 22:11:44
97
原创 LangGraph 状态管理全攻略:如何处理多轮对话中的状态持久化?
本文从第一性原理出发,系统拆解 LangGraph 作为图驱动的多智能体/工作流执行引擎的核心状态设计,通过层层递进的解释框架,阐述状态在节点、边、全局上下文三层空间中的流转机制,并聚焦于生产环境中最关键的挑战——多轮对话的状态持久化**展开深度剖析。文章包含理论推导、Mermaid 可视化架构、算法复杂度分析、生产级 Python 核心实现、真实金融客户服务对话的完整项目案例(含环境配置、系统架构/接口/核心代码、最佳实践),以及行业发展趋势与开放问题。
2026-06-11 21:20:51
163
原创 多智能体系统的通信协议:标准 API 与 P2P 消息传递的优劣分析
可达性:消息能准确送到目标智能体,成功率≥99.9%一致性:多个智能体的状态同步不会出现冲突,符合业务逻辑要求时效性:端到端时延满足业务需求(比如对话场景≤200ms,工业控制≤10ms)层级作用对应技术物理层底层数据传输传输层消息的可靠传输、丢包重试会话层连接管理、身份认证语义层消息格式标准、协议规范语用层消息的业务逻辑处理、一致性保障分布式事务/Raft算法。
2026-06-11 20:19:12
148
原创 游戏AI:NPC的智能进化之路
NPC的进化之路本质上是“开发者预设内容越来越少,AI自主决策越来越多”的过程:从最早的完全硬编码的脚本傀儡,到现在可以自主理解玩家输入、生成行为的大模型驱动NPC,技术的发展一直在提升游戏的沉浸感和可玩性。未来的游戏一定会因为智能NPC变得更加精彩,甚至会成为我们的另一个人生。
2026-06-11 19:22:56
235
原创 用博弈论设计稳定的 Multi-Agent 协作系统
多智能体系统(Multi-Agent System, MAS)是由多个相互作用的智能体(Agent)组成的计算系统。每个智能体都是一个自主的实体,能够感知环境、做出决策并采取行动,以实现其特定目标。这些智能体之间通过通信、协作或竞争来共同解决单个智能体难以完成的复杂问题。智能体(Agent)自主性(Autonomy):智能体能够在没有人类或其他实体直接干预的情况下运行,并对其行为和内部状态有一定的控制能力。反应性(Reactivity):智能体能够感知环境,并对环境的变化做出及时反应。
2026-06-11 02:30:15
165
原创 企业级Agent上线清单:安全评审、权限隔离、成本监控与SLA保障
随着大模型技术的落地,企业级智能Agent已经成为客服、运维、数据分析、内部效率工具等场景的核心组件,但70%以上的企业Agent上线过程缺乏标准化合规流程,导致频繁出现prompt注入数据泄露、越权访问核心资产、大模型调用成本超支10倍、业务可用性不足85%等问题。本文基于100+头部企业Agent落地的实践经验,构建了覆盖安全评审、权限隔离、成本监控、SLA保障。
2026-06-11 01:39:04
269
原创 代码审查 Agent:如何减少漏洞与回归
随着敏捷研发、微服务架构的普及,软件迭代速度提升3-10倍的同时,代码漏洞与回归故障已成为企业研发体系的核心痛点:CVE 2023年统计显示62%的生产级漏洞来自代码审查阶段的遗漏,81%的线上P0故障由代码变更引发的回归问题导致。传统规则型代码审查工具(如SonarQube)误报率高达40%以上,人工审查人均每天仅能审查200行有效代码,完全无法匹配现代研发节奏。
2026-06-11 00:37:42
217
原创 哪些行业会最先被 AI Agent Harness Engineering 颠覆?
(不是线性的,而是根据中间结果动态调整的,比如当「市场情报Agent」发现新加坡通信部2024年4月出台了「边缘设备本地数据存储比例不得低于80%」的政策后,立刻触发了「用户行为Agent」优先分析新加坡市场的高价值用户,同时触发「产品VP Agent」(演示者临时创建的,没有预设分工)去查产品是否支持「边缘数据本地加密存储+按需同步到AWS新加坡以外的合规区域」的功能),有明确的。这一章的内容非常重要——它不仅是第三章「核心内容/实战演练」的基础,也是第四章「进阶探讨/最佳实践」的基础。
2026-06-10 23:41:27
57
原创 面向翻译 Agent 的 Harness 术语表动态注入
本文提出的「面向翻译 Agent 的 Harness 术语表动态注入方案」,无需微调大模型,通过结构化术语库构建-混合召回-上下文感知过滤-动态Prompt注入-后置校验的全流程设计,实现了术语的精准动态注入,翻译准确率提升至97.2%,翻译耗时仅增加5%,术语库更新可实时生效,无需重新训练模型。概念定义Harness 术语Harness 平台中具有专属含义的词汇,包括产品名、功能组件名、操作动作、配置属性四大类动态术语注入。
2026-06-10 22:50:16
94
原创 AI Agent Harness重试机制:任务容错设计
Harness直译是"线束、安全带",在AI Agent架构中,Harness是管控Agent全生命周期执行的核心底座层,负责协调Agent的思考推理、工具调用、记忆读写、状态管理等所有核心流程,是Agent系统的"操作系统内核"。而重试机制是Harness中容错模块的核心组成部分,负责在流程执行出现错误时,自动执行重试逻辑,保障任务的最终成功率。在不破坏Agent思考链连贯性、不过度增加成本的前提下,针对可恢复的瞬态错误,自动调整上下文、等待时机后重新执行失败步骤的容错机制# 可重试错误类型。
2026-06-10 21:59:08
120
原创 Embedding 模型选择对 RAG Harness 效果的影响
检索增强生成(RAG)已经成为解决大语言模型幻觉、实现领域知识落地的标配方案,但80%的RAG落地团队都遭遇过「效果始终不达标、优化找不到方向」的痛点。大多数开发者会把优化重心放在大模型选择、分块策略、Prompt工程上,却忽略了Embedding模型作为RAG系统的第一道入口,对最终效果的影响权重超过40%。
2026-06-10 21:07:59
182
原创 LangGraph 节点状态持久化避坑指南:序列化与恢复实战
LangGraph作为当前最火的Agent开发框架,核心优势就是通过状态机的方式管理多轮Agent的执行流程,而状态持久化是LangGraph生产落地的必要前提服务重启、扩容时不会丢失用户对话上下文,保证Agent执行连续性分布式部署时多实例可以共享同一个对话的状态,支持负载均衡可回溯历史执行过程,方便排查Agent执行异常的问题支持离线任务恢复,比如长周期的研究Agent中途中断后可以接着执行。
2026-06-10 20:12:02
99
原创 AI Agent Harness Engineering 生态工具链盘点:2026 开发者必备的 15 款核心工具
本文盘点了2026年AI Agent Harness Engineering生态的15款核心工具,覆盖了从开发、编排、记忆、观测、安全、部署到评测的全流程。Agent开发的门槛已经从之前的需要精通LLM、RAG、分布式系统,降低到了只需要了解业务逻辑,用成熟的工具链就能快速搭建生产级Agent系统。未来3年Agent的落地渗透率将超过70%,掌握这些工具将是AI开发者的核心竞争力。
2026-06-10 19:15:28
251
原创 Harness 中的结果排序器:合并多个 Agent 的排名
术语定义排序列表(Permutation)单个Agent返回的有序结果集合,通常包含文档ID、排名、匹配分数三个核心字段排名融合(Rank Aggregation)将多个独立的排序列表合并为单一排序列表的过程,目标是最大化最终列表的相关性位置权重排名中不同位置的重要程度,通常排名越靠前权重越高,符合用户的浏览习惯NDCG(归一化折损累积增益)排序质量的核心评估指标,取值范围0-1,越高表示排序结果越符合相关性要求MRR(平均倒数排名)
2026-06-10 02:17:56
258
原创 医疗健康 AI Agent Harness Engineering 创新:远程诊断与慢病管理的智能协作方案
专业性:经过医疗领域专属数据微调,输出符合诊疗规范,专业能力不低于全科医生平均水平自主性:可以主动采集患者信息、调用医疗知识库、发起流程流转,不需要人工干预每一步操作可交互性:可以和患者、医生、其他Agent进行自然语言交互,完成信息对齐与任务协同我们按照功能将医疗AI Agent分为5类:| Agent类型 | 核心功能 | 能力要求 || 患者交互Agent | 病史采集、健康咨询、随访提醒、用药指导 | 医患对话理解能力、患者情绪识别能力 |
2026-06-10 01:16:17
170
原创 医院、律师事务所如何落地智能体
很多机构之前也尝试过用AI工具:医院上了智能问答机器人,答非所问率超过40%;律所买了法律检索工具,还是需要人工筛选上千条结果。没有记忆:无法关联机构的私有数据,比如患者的历史病历、律所的过往案件记录;没有自主性:只能完成固定的单一任务,无法自主规划流程、调用多个工具完成复杂任务;没有合规机制:输出不可控,容易出现专业错误,且操作不留痕,无法满足医疗、法律行业的强监管要求。而智能体是具备感知、记忆、推理、工具调用、合规校验能力的自主实体,可以完美适配这两个行业的特殊需求。
2026-06-10 00:20:01
247
原创 AI Agent Harness Engineering 的角色设定:如何让 AI 拥有“人格”?
Harness的本义是「束具、操控框架」,AI Agent Harness Engineering(AI Agent束具工程,下文简称「Harness工程」)是给AI Agent套上一层稳定「人格外壳」的全生命周期工程体系:它通过结构化的人格建模、全链路的行为约束、全息记忆管理、实时风格校准、价值对齐审计五大模块,让AI的输出始终符合预设的身份、性格、价值观、行为模式,最终表现出人类可感知的「人格特征」。对比维度核心目标单次任务输出符合预期完成复杂多步任务全生命周期行为符合人格预期作用周期。
2026-06-09 23:18:38
127
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅