<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[谢文峰的博客]]></title><description><![CDATA[全栈JavaWeb]]></description><link>https://blog.csdn.net/xiewenfeng520</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; xiewenfeng520]]></copyright><item><title><![CDATA[Codex Team Runtime 03 | 对话压缩之后，Agent 如何找回自己的团队角色？]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/165624695</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/165624695</guid><author>xiewenfeng520</author><pubDate>Wed, 16 Sep 2026 18:47:47 +0800</pubDate><description><![CDATA[在长期协作中，Agent 可能因对话压缩而遗忘团队角色。为解决此问题，系统通过独立的 Team Registry 持久化成员身份、归属团队与职责，并借助 MCP 提供精确读取接口。角色召回需基于真实任务身份（hostId + threadId）查询，区分“身份有效”与“授权有效”。机制分离身份、职责与进度信息，确保成员能准确找回所属团队、负责人及权限边界。关键在于：身份登记由 Manager 统一管理，成员主动读取并核对上下文，避免误判。返回结果分四类，分别指导后续行为，保障协作一致性。]]></description><category></category></item><item><title><![CDATA[Codex Team Runtime 02 | 强模型做 Manager，低成本模型做 Worker：AI 开发团队的成本账怎么算？]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/165604497</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/165604497</guid><author>xiewenfeng520</author><pubDate>Wed, 16 Sep 2026 12:25:56 +0800</pubDate><description><![CDATA[本文探讨在AI开发团队中，如何通过“强模型做Manager、低成本模型做Worker”来优化成本。核心观点是：仅降低执行模型成本不足以节省总开支，需计入任务拆分、上下文传递、审查与返工等协作开销。合理分工应确保强模型聚焦需求确认、任务拆解与验收，而低成本模型承担边界清晰的执行任务。实际配置需明确角色规则与模型上限，避免因层级委派导致资源失控。最终成本优化依赖于对Token用量、费用计价与时间投入的综合评估，而非单一模型价格比较。]]></description><category></category></item><item><title><![CDATA[Codex Team Runtime 01 | 从一个 Codex 对话，到一个可参与的 AI 开发团队]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/165485841</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/165485841</guid><author>xiewenfeng520</author><pubDate>Tue, 15 Sep 2026 17:41:52 +0800</pubDate><description><![CDATA[从一个 Codex 长对话出发，介绍 codex-team-runtime 如何用 Manager、Worker 和 Liaison 组织可参与的 AI 开发团队，涵盖原生任务、身份恢复、独立验收及 Token 与 MCP 指标，并说明开发版本的实现边界。]]></description><category></category></item><item><title><![CDATA[都说问一句就能测出 GPT6 降智，我试完更困惑了]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/165363472</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/165363472</guid><author>xiewenfeng520</author><pubDate>Mon, 14 Sep 2026 21:57:38 +0800</pubDate><description><![CDATA[本文作者通过测试模型的知识截止日期与“鹈鹕骑自行车”SVG生成任务，质疑GPT-6是否被“降智”。发现模型在不同对话中对知识截止日期回答矛盾，且同一提示下多模型输出差异显著。尽管初步测试显示部分模型表现退步，但单次实验无法确证模型身份或能力变化。作者强调：判断模型退化需固定条件、重复测试、匿名评价，并保留历史数据对比。真正的判断应基于可复现的结果，而非一句自述或单一样本。]]></description><category></category></item><item><title><![CDATA[AI 越能干，为什么你越不能只等需求？]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/165242247</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/165242247</guid><author>xiewenfeng520</author><pubDate>Sun, 13 Sep 2026 21:06:37 +0800</pubDate><description><![CDATA[AI 越能干，工程师越不能只停留在“实现需求”。本文从一个报表导出场景出发，讨论如何识别需求背后的真实问题、用小步试验验证方向、发挥工程经验，并在主动担当与组织边界之间保持平衡。]]></description><category></category></item><item><title><![CDATA[吴恩达 AI 工程技能图（9·12）：不只实现需求，还要推动产品成形]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/165121970</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/165121970</guid><author>xiewenfeng520</author><pubDate>Sat, 12 Sep 2026 17:03:16 +0800</pubDate><description><![CDATA[吴恩达在《AI Engineering Skills Map: Shaping the build》中提出，AI Engineering 不只要求开发者实现既定 spec，也要求推动构建与反馈循环、参与产品决策、沟通引领，并主动担当、对结果负责。本文为原文的结构化中文翻译。]]></description><category></category></item><item><title><![CDATA[OpenAI《加速研究》：增长曲线背后，指标设计才是重点]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/165119749</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/165119749</guid><author>xiewenfeng520</author><pubDate>Sat, 12 Sep 2026 15:41:42 +0800</pubDate><description><![CDATA[从 OpenAI《Research acceleration: The view inside OpenAI》的增长曲线出发，拆解统计对象、分母、并行规则与结果证据，并给出 Agent、trace、eval 和 skill 的指标设计方法。]]></description><category></category></item><item><title><![CDATA[Codex Token 统计 Skill 升级：一句话打开每日用量看板]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164595401</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164595401</guid><author>xiewenfeng520</author><pubDate>Tue, 08 Sep 2026 12:07:14 +0800</pubDate><description><![CDATA[开源项目 codex-token-usage-skill 新增每日 HTML 用量看板，默认在外部浏览器打开。支持总量与净用量切换、缓存构成、每日明细排序及 CSV 导出，沿用本地日志统计方式，固定模板生成，无需部署服务。]]></description><category></category></item><item><title><![CDATA[Agent 能自己干活以后，工程师什么时候该插手？]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164494799</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164494799</guid><author>xiewenfeng520</author><pubDate>Mon, 07 Sep 2026 20:09:15 +0800</pubDate><description><![CDATA[Coding Agent 能自己干活以后，工程师的价值更多体现在注意力的分配。本文结合吴恩达的技能图，讨论目标变化、证据停滞和影响扩大三个介入信号，并以数据导出任务说明如何约定完成标准、验证结果和权限边界，让一次介入减少下一次重复提醒。]]></description><category></category></item><item><title><![CDATA[ToDesk 连接 Linux 后分辨率过低的解决方法]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164457831</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164457831</guid><author>xiewenfeng520</author><pubDate>Mon, 07 Sep 2026 14:04:00 +0800</pubDate><description><![CDATA[ToDesk连接Linux后分辨率过低，源于桌面本身分辨率降低，而非ToDesk设置。可用xrandr查看输出名称并临时切换至1920×1080；将命令加入启动应用实现自动生效。若无该模式，用cvt创建。注意输出名称、X11/Wayland等差异。]]></description><category></category></item><item><title><![CDATA[吴恩达 AI 工程技能图：用好 Coding Agent 的五项关键能力]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164430534</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164430534</guid><author>xiewenfeng520</author><pubDate>Sun, 06 Sep 2026 20:54:20 +0800</pubDate><description><![CDATA[Andrew Ng（吴恩达）介绍使用 Coding Agent 的三阶段工作流，以及工作流引导、自主性配置、成果审查、环境定制和基础原理五项能力。本文提供完整结构化译文与阅读导航，强调持续迭代和高质量判断，而非单纯追求长时间自主运行。]]></description><category></category></item><item><title><![CDATA[企业 Agent Runtime | 代码完成，不等于项目完成]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164400994</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164400994</guid><author>xiewenfeng520</author><pubDate>Sat, 05 Sep 2026 16:01:52 +0800</pubDate><description><![CDATA[代码完成只是局部实现声明。本文从 Agent 工作流中的 Lifecycle Drift 出发，提出 Completion Contract：以工作身份和变更版本为锚，关联证据、接受权限、状态对账与交接边界，让一次完成声明真正成为可复核、可续接的项目状态。]]></description><category></category></item><item><title><![CDATA[GPT-6 Astra 来了：从操作电脑到科学研究，这次升级有多强？]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164397213</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164397213</guid><author>xiewenfeng520</author><pubDate>Sat, 05 Sep 2026 10:52:35 +0800</pubDate><description><![CDATA[GPT-6 Astra 已扩大开放至 Plus 和 Business。本文从开发者视角梳理产品入口与 API 成本、前端验证、Codex 长任务上下文、安全监控和质数间隙 186，结合官网案例与图解，说明能力提升的条件，以及如何评估实际项目中的质量、人工修改和完整成本。]]></description><category></category></item><item><title><![CDATA[GPT-6 Astra 跑出两个接近满分怎么看？这些 Benchmark 到底在测什么]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164366604</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164366604</guid><author>xiewenfeng520</author><pubDate>Fri, 04 Sep 2026 13:30:52 +0800</pubDate><description><![CDATA[ARC-AGI-3 的 99.9%、FrontierMath Tier 4（v2）的 97.6% 意味着什么？为什么蜜罐测试的 0% 是好消息？本文解读 GPT-6 Astra 九项 Benchmark，讲清任务、计分、运行条件与结论边界，并说明 API 成本、虚线参考分数、部分得分和百分点，帮助开发者把跑分用于模型选型。]]></description><category></category></item><item><title><![CDATA[读完 Google Research WikiSkill，我重新理解了 Agent 自进化的边界]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164339735</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164339735</guid><author>xiewenfeng520</author><pubDate>Thu, 03 Sep 2026 20:47:47 +0800</pubDate><description><![CDATA[读完 WikiSkill，我重新区分了技能演化、Runtime 基础能力与应用验证：技能可以回滚，知识仍可保留，但持久知识不等于正确知识。文章讨论经验的来源、访问边界与可信度，并提出尚未运行的单 Skill 对照实验，用独立评估检验结构化知识的增量价值。]]></description><category></category></item><item><title><![CDATA[企业 Agent Runtime | 项目知识需要生命周期]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164298507</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164298507</guid><author>xiewenfeng520</author><pubDate>Wed, 02 Sep 2026 15:31:59 +0800</pubDate><description><![CDATA[<think>我们只需要根据给出的内容生成≤150字的文章摘要。内容主要讲项目知识生命周期，强调Repository Context不等于Project Knowledge，项目知识是变化状态的生命周期。需要概括核心观点。输出字数有限，需精炼。</think>项目知识并非从仓库检索出的静态上下文，而是由证据支撑、贯穿需求到交接的生命周期。仅有Repository Context，Agent 能写对Patch，却可能沿用失效Plan、进入错误Scope，导致项目状态漂移。项目知识需状态转换与对齐，才能确保“当]]></description><category></category></item><item><title><![CDATA[3600 个 Skills、每天 3 万次执行：Uber 为什么没有被 Token 账单拖垮？]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164268352</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164268352</guid><author>xiewenfeng520</author><pubDate>Tue, 01 Sep 2026 21:14:49 +0800</pubDate><description><![CDATA[<think>我们只需要根据内容生成摘要，≤150字。需要抓住核心：Uber在Agent使用量大幅增长下控制成本的方法，包括成本公式、模型路由、上下文压缩、MCP工具优化等。摘要要简洁。</think>Uber 在 Agent 周活用户增长 7 倍、请求量增长 9.4 倍的同时，通过将总成本拆解为六变量公式，构建 Benchmark 驱动的模型路由、上下文压缩与缓存策略、MCP 工具按需加载等系统，使 AI 支出稳定，单次成本显著下降。]]></description><category></category></item><item><title><![CDATA[从 Domain Workload 到垂直领域 Agent]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164268158</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164268158</guid><author>xiewenfeng520</author><pubDate>Tue, 01 Sep 2026 20:59:52 +0800</pubDate><description><![CDATA[Codex、Claude 等通用 Agent 已能推理和调用工具，但要让一个具体领域持续运转，Skill 和 Harness 还不够。Skill 暴露领域语义与能力；Harness 承载工作负载、流程、证据与恢复。真正让领域成长为垂直 Agent 的，是 Agent Runtime：它连接身份、权限、知识、工作流和人类监督，使模型、Skill、Harness 与会话可替换，而领域仍连续、可审计、可治理。]]></description><category></category></item><item><title><![CDATA[Coding Agent 越强，软件基础和工程经验为什么反而更值钱？]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164174400</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164174400</guid><author>xiewenfeng520</author><pubDate>Sat, 29 Aug 2026 23:29:22 +0800</pubDate><description><![CDATA[Coding Agent 正在显著降低代码实现门槛，但它没有消除软件工程中的约束、取舍与后果。经验较少的开发者可以借助 Agent 更快做出可运行版本；有判断力的资深工程师，则能把项目背景、故障记忆和工程约束转化为更高质量的任务描述、检查与决策。真正升值的不是工作年限，而是经过反馈、复盘和修正形成的判断力。]]></description><category></category></item><item><title><![CDATA[吴恩达再次更新 AI 工程技能图：Coding Agent 时代，软件工程基础还重要吗？]]></title><link>https://blog.csdn.net/xiewenfeng520/article/details/164168929</link><guid>https://blog.csdn.net/xiewenfeng520/article/details/164168929</guid><author>xiewenfeng520</author><pubDate>Sat, 29 Aug 2026 13:42:43 +0800</pubDate><description><![CDATA[吴恩达指出，Coding Agent 能降低门槛，却不会让软件工程基础过时。开发者需掌握全栈、数据、架构、安全和生产运维，才能识别延迟、成本、可用性等取舍，并为 Agent 提供正确背景。语法记忆的重要性正在下降，真正拉开差距的，是理解软件如何运行和演进，并引导 Agent 作出可靠工程决策的能力。]]></description><category></category></item></channel></rss>