- 博客(7)
- 收藏
- 关注
原创 一个 Agent 看完 30 个文件后,为什么该让它先退出?
本文是「从零理解 Claude Code」系列的第6篇,探讨了如何通过子Agent机制处理复杂任务中的上下文隔离问题。文章指出,待办列表(TodoWrite)虽能记录任务进度,但无法解决单个任务复杂度高的问题。子Agent的引入创造了一条上下文边界,允许主Agent将独立探索工作委派给子Agent执行,最后仅接收精简结论而非完整过程,从而避免主对话过度膨胀。 关键点包括: 子Agent从全新消息列表启动,独立执行任务后返回总结 上下文隔离仅限于对话历史,文件系统和命令执行环境仍共享 实现上限制子Agent不
2026-07-28 21:31:41
221
原创 Agent 最怕的不是不会写代码:一个 TodoWrite 如何让它不跑偏?
摘要: 本文探讨了复杂任务中Agent容易偏离目标的问题,并介绍了todo_write机制如何通过维护可追踪的任务状态来改善这一现象。当任务步骤变长时,Agent容易陷入局部反馈而忽略全局目标。todo_write将任务拆解为带状态的待办列表(pending/in_progress/completed),通过动态更新帮助Agent在工具调用间隙回溯任务全貌。该工具不直接参与执行,而是作为“工作记忆”锚点,配合提醒机制防止模型长时间忽略计划。实现上,它通过工具调用记录嵌入模型上下文,无需改造主循环,仅需维护状
2026-07-28 21:29:39
263
原创 一堆 if 把 Agent Loop 写乱了:Hooks 到底解决了什么?
本文探讨了如何通过Hooks机制优化Agent Loop的设计,解决核心逻辑与扩展功能混杂导致的代码臃肿问题。文章指出,随着权限检查、日志记录等附加功能的增加,主循环逐渐变成各种规则的汇合点,导致维护困难。作者提出将Agent运行过程拆分为四个事件节点(用户提交、工具执行前、工具执行后、任务结束),通过注册表实现Hook的灵活挂载。重点分析了权限检查如何从硬编码转变为PreToolUse Hook,并讨论了多个Hook的执行顺序对系统行为的影响。文章还展示了PostToolUse Hook的应用场景,如输出
2026-07-27 23:00:00
369
原创 Agent 能调用工具以后,谁来决定这条命令能不能执行?
本文探讨了在AI Agent工具调用中引入权限检查机制的必要性与实现方案。当Agent能够实际修改文件和执行命令时,必须建立安全边界以防止危险操作。作者提出三层防护机制: 硬性拒绝清单:直接拦截高风险命令(如sudo、rm -rf); 用户确认机制:对潜在风险操作(如文件删除)需人工确认; 工作目录隔离:限制文件操作范围防止越权访问。 这些检查在工具执行前完成,形成"直接执行/用户确认/立即拒绝"的分级处理流程。通过保持默认拒绝策略和合理的检查顺序(先危险判定后用户确认),在保持Agent功能性的同时确保系
2026-07-20 15:15:46
467
1
原创 多加一个工具,只加一行:Agent 是怎么管理工具的?
本文介绍了如何为Agent添加多个工具并实现工具分发管理。核心思路是通过工具分发表(TOOL_HANDLERS)将工具调用与具体实现解耦,使主循环保持简洁。文章以添加read_file、write_file等文件操作为例,展示了从单工具(bash)到多工具的演进过程:定义工具描述、实现处理函数、注册到分发表。这种设计让新增工具只需添加映射关系,无需修改主循环。同时文章也提到路径校验等安全考虑,并指出多工具设计通过提供更细粒度的能力,减少了模型处理无关细节的负担。最终强调工具分发的设计模式比具体工具更重要。
2026-07-20 00:57:36
411
原创 一个 while True 循环,为什么可以成为 Agent 的起点?
本文是「从零理解 Claude Code:20 个 Agent Harness 机制」系列的第2篇,探讨了Agent的核心工作循环机制。文章指出,Agent的核心逻辑其实是一个while True循环,该循环负责在模型需要调用工具时自动执行工具,并将结果反馈给模型继续决策,直到任务完成。循环通过判断模型的stop_reason字段决定是否继续(tool_use时继续,否则退出),并通过不断累积的messages上下文保持任务连贯性。文中通过Python代码示例展示了如何实现这一核心循环,包括模型请求、回复保
2026-07-19 21:50:11
287
原创 别再只聊 Prompt 了:用 20 个机制拆解 Claude Code 的 Agent Harness
本文是「从零理解Claude Code」系列的开篇,提出构建AI Agent的核心在于设计Harness环境而非仅关注Prompt或工作流编排。作者将Agent比作"驾驶员+车辆系统"的组合,其中Harness提供工具、知识、观察和权限边界等支持。文章揭示Agent的基本运行逻辑是一个持续循环:模型推理→工具调用→结果反馈→继续推理,强调复杂任务需要动态决策而非预设流程。系列后续将分6个阶段逐步拆解20个机制,从基础循环到多Agent协作,帮助读者掌握构建实用Agent系统的核心方法。
2026-07-19 21:09:15
529
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅