<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[小程故事多的博客]]></title><description><![CDATA[2006-2025从事了19年软件开发，架构和技术管理
腾讯云TVP，腾讯云架构师同盟理事，华为云HCDE专家，阿里云MVP，前极客时间每日一课出品人，出版图书：《高可用可伸缩微服务架构》《深入分布式缓存》《Spring5设计模式》]]></description><link>https://blog.csdn.net/u013970991</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; u013970991]]></copyright><item><title><![CDATA[从初代Transformer到千亿参数大模型，一文读懂大语言模型架构演化全历程]]></title><link>https://blog.csdn.net/u013970991/article/details/167272761</link><guid>https://blog.csdn.net/u013970991/article/details/167272761</guid><author>u013970991</author><pubDate>Thu, 08 Oct 2026 13:55:20 +0800</pubDate><description><![CDATA[本文系统梳理了从2017年原始Transformer到现代千亿参数大模型的架构演化历程。初代双模块架构专为机器翻译设计，编码器实现全局语义理解，解码器通过掩码自注意力与交叉注意力完成生成。随着任务统一为自回归生成，架构演变为仅保留解码器的Decoder-only模式，奠定GPT、LLaMA等主流模型基础。后续在归一化（Pre-Norm/RMSNorm）、位置编码（RoPE）、激活函数（SwiGLU）及注意力机制等方面持续优化，显著提升模型性能与推理效率，推动大模型向更高效、更强泛化能力发展。]]></description><category></category></item><item><title><![CDATA[AI Agent 基础知识，从最小循环到落地可靠智能系统]]></title><link>https://blog.csdn.net/u013970991/article/details/167272008</link><guid>https://blog.csdn.net/u013970991/article/details/167272008</guid><author>u013970991</author><pubDate>Thu, 08 Oct 2026 13:28:25 +0800</pubDate><description><![CDATA[综合全文，AI Agent的完整知识体系可以归纳为四大核心主线，也是所有智能体系统的底层骨架。认知层依托大模型、规划能力，实现目标理解、任务拆解与智能决策，是Agent的大脑。执行层依靠Agent循环、工具调用、MCP协议，打通从决策到外部操作的闭环，是Agent的手脚。状态层通过上下文工程、RAG检索、长短记忆体系，维持任务连续性和信息精准度，是Agent的记忆。治理层依托Harness工程体系、Hook管控、权限审计、评估恢复能力，保障系统安全稳定运行，是Agent的底座。]]></description><category></category></item><item><title><![CDATA[B端AI落地终局之辩，Agent从来不是if-else的简单换皮]]></title><link>https://blog.csdn.net/u013970991/article/details/167262385</link><guid>https://blog.csdn.net/u013970991/article/details/167262385</guid><author>u013970991</author><pubDate>Thu, 08 Oct 2026 09:55:53 +0800</pubDate><description><![CDATA[B端AI Agent并非if-else规则的简单换皮，其核心价值在于重构了业务落地的成本结构。传统规则引擎受限于高成本、慢迭代、难适配，难以覆盖长尾需求与模糊指令。而AI Agent依托大模型实现零成本规则生成、自然语言直接交互、动态流程编排，突破了“高频完善、长尾缺失”的瓶颈。它不改变底层逻辑，却通过效率跃迁，让十年前无法落地的场景得以规模化应用。真正差异不在代码，而在成本、速度与适应性质变。]]></description><category></category></item><item><title><![CDATA[搭建24小时不间断多Agent集群，解锁无人值守的AI自动化开发新模式]]></title><link>https://blog.csdn.net/u013970991/article/details/167212561</link><guid>https://blog.csdn.net/u013970991/article/details/167212561</guid><author>u013970991</author><pubDate>Wed, 07 Oct 2026 09:51:50 +0800</pubDate><description><![CDATA[本文分享一套无需人工值守的多Agent自动化开发集群搭建方案，基于层级化架构（监督、管理、决策、执行四层），结合Muse、Hermes、DSH、Codex与Jev模型，实现任务拆分、自主纠错、进度督办与自动提交。通过轻量化部署、资源差异化分配及两大核心文档规范（AGENTS.md与PROJECT_IMPLEMENTATION_PLAN.md），确保流程可控、安全稳定。实战中有效规避了AI盲目开发、资源浪费与卡点停滞问题，真正实现24小时无人干预的高效迭代，为个人开发者提供可复用的智能开发范式。]]></description><category></category></item><item><title><![CDATA[百万级Agent集群的终极困境，真正的瓶颈从来不是智能，而是分布式系统]]></title><link>https://blog.csdn.net/u013970991/article/details/167211672</link><guid>https://blog.csdn.net/u013970991/article/details/167211672</guid><author>u013970991</author><pubDate>Wed, 07 Oct 2026 09:19:25 +0800</pubDate><description><![CDATA[当下AI行业的共识似乎陷入了一个固定误区，绝大多数人都在拼命打磨单个Agent的能力。我们不断微调提示词，优化工具调用逻辑，升级模型参数，试图让独立的智能体变得更聪明、更全能。大家默认的逻辑是，单个Agent的智能足够强，只要批量复制堆叠，成千上万个、甚至上百万个Agent组成的集群，就能产生指数级的集体智能，解决一切复杂业务问题。但无数前沿实验和工程落地案例已经戳破了这个幻想。当Agent的数量从个位数扩张到百位数、千位数，最终抵达百万级规模时，制约系统性能的核心问题，早已不是单个模型的推理能力。]]></description><category></category></item><item><title><![CDATA[拆解Claude Code，重新定义AI编程智能体的设计逻辑与落地实践]]></title><link>https://blog.csdn.net/u013970991/article/details/167175673</link><guid>https://blog.csdn.net/u013970991/article/details/167175673</guid><author>u013970991</author><pubDate>Tue, 06 Oct 2026 19:49:17 +0800</pubDate><description><![CDATA[本文深度解析Claude Code智能编程Agent的设计精髓，从ReAct循环驱动的Coding Harness架构出发，揭示其基于“安全可控与高效智能平衡”的核心理念。通过五大设计理念与十三项系统原则，构建起覆盖权限管控、上下文管理、任务连贯性与场景自适应的完整体系。四大核心模块实战落地，实现代码生成、调试优化、环境配置等全流程自动化，兼顾安全性与开发效率，展现现代AI Agent系统的底层竞争力与通用设计范式。]]></description><category></category></item><item><title><![CDATA[深度拆解AI Agent，从核心原理、运行机制到工程落地与风险治理]]></title><link>https://blog.csdn.net/u013970991/article/details/167175535</link><guid>https://blog.csdn.net/u013970991/article/details/167175535</guid><author>u013970991</author><pubDate>Tue, 06 Oct 2026 17:34:15 +0800</pubDate><description><![CDATA[本文系统解析AI Agent的底层逻辑，揭示其并非简单升级版聊天机器人，而是具备自主感知、决策、执行与迭代能力的闭环智能系统。通过六层架构（目标、认知、运行、行动、信息、治理）全面拆解其运行机制，厘清与Chatbot、Workflow、RPA的本质区别，并深入剖析Agent Loop核心循环，提供可落地的伪代码模板，助力开发者精准选型与高效实践。]]></description><category></category></item><item><title><![CDATA[可落地的运维知识本体体系，六层建模、八类谓词与故障传播推理方案]]></title><link>https://blog.csdn.net/u013970991/article/details/166898343</link><guid>https://blog.csdn.net/u013970991/article/details/166898343</guid><author>u013970991</author><pubDate>Wed, 30 Sep 2026 15:40:43 +0800</pubDate><description><![CDATA[本文提供一份可直接落地的本体建模手册，系统解答“实体怎么建、关系怎么建、语义如何组织、故障如何传播”四大核心问题。基于四元组模型（E, A, R, C），构建6层实体体系、8类谓词与15条原子规则，明确实体分类判据、稳定标识机制（逻辑/实例双层）、属性绑定规范及3条完整故障传导链。通过四步建模流程（实体→关系→语义→规则），实现从静态拓扑到动态推理的闭环，支持故障传播路径精准推演与置信度计算，适用于云原生环境下的可观测性系统建设。]]></description><category></category></item><item><title><![CDATA[基于本体来实现AIOps，一步步教你实战，从一条报错日志到根因]]></title><link>https://blog.csdn.net/u013970991/article/details/166897475</link><guid>https://blog.csdn.net/u013970991/article/details/166897475</guid><author>u013970991</author><pubDate>Wed, 30 Sep 2026 14:57:45 +0800</pubDate><description><![CDATA[凌晨两点，订单服务因磁盘满触发告警链。五条跨层级告警实为同一故障的投影：资源层（磁盘满）、实例层（容器重启）、服务层（连接池超时）、业务层（支付失败）。系统通过静态本体图实现根因追溯——日志仅定位至“订单服务”节点，遍历器逆向沿“propagates”边回溯，结合传导延迟（TTP），精准锁定“node-03数据盘写满”为根本原因。本体不主动触发，而是以图结构承载因果关系，使故障推理可验证、可复现。]]></description><category></category></item><item><title><![CDATA[拆解DeepSeek Harness，从内核设计到插件开发的完整技术逻辑]]></title><link>https://blog.csdn.net/u013970991/article/details/166840836</link><guid>https://blog.csdn.net/u013970991/article/details/166840836</guid><author>u013970991</author><pubDate>Tue, 29 Sep 2026 13:33:16 +0800</pubDate><description><![CDATA[DeepSeek Harness（dsh）是面向生产级AI Agent的运行时框架，提出“Agent = Model + Harness”架构，实现推理与工程能力彻底解耦。其核心创新在于三大原则：事件溯源（不可变日志保障可追溯）、能力接缝（插件化服务实现策略与执行分离）、无特权内核（所有组件可替换、可热更新）。基于Cordis微内核，dsh采用声明式配置、插件化架构，支持全链路可扩展、状态可回溯、多模型无缝切换，突破传统框架在状态管理、动态扩展与安全管控上的瓶颈，构建可组合、可测试、可热更新的Agent底层]]></description><category></category></item><item><title><![CDATA[十张图，一个会话，把 Claude Code harness 拆开看]]></title><link>https://blog.csdn.net/u013970991/article/details/166777280</link><guid>https://blog.csdn.net/u013970991/article/details/166777280</guid><author>u013970991</author><pubDate>Mon, 28 Sep 2026 10:04:16 +0800</pubDate><description><![CDATA[本文通过十张图解析 Claude Code Harness 的核心架构，揭示其背后四层系统：入口、记忆、循环与治理。强调模型仅负责决策，真正驱动效率的是框架的工程设计——从上下文加载、agentic 循环到权限控制、subagent 隔离。文章指出，所谓“模型不听话”，实为 harness 配置失效；关键在于厘清规则归属（人写 CLAUDE.md，模型记 MEMORY.md）、掌握 slash 控制面的使用节奏，并坚持“先建工作台，再干活”的原则，方能让 AI 真正成为可预期的协作伙伴。]]></description><category></category></item><item><title><![CDATA[LangGraph断点恢复与幂等执行实战，解决Agent中途宕机与重复执行难题]]></title><link>https://blog.csdn.net/u013970991/article/details/166776774</link><guid>https://blog.csdn.net/u013970991/article/details/166776774</guid><author>u013970991</author><pubDate>Mon, 28 Sep 2026 09:52:59 +0800</pubDate><description><![CDATA[本文聚焦LangGraph框架下AI Agent的断点恢复与幂等执行实战，针对服务中断导致工作流重跑引发的资源浪费与数据重复问题，提出“状态持久化+幂等控制”双引擎解决方案。通过构建包含报告生成、人工审批、数据入库的最小业务链路，详解Checkpointer持久化、thread_id唯一标识、interrupt暂停机制及业务幂等键设计，揭示内存断点不可用于生产的核心误区，并以SqliteSaver实现跨进程断点续跑，最终实现任意节点中断后精准恢复、外部操作零重复的高可靠性部署。]]></description><category></category></item><item><title><![CDATA[从AI写代码到AI软件工厂，企业级Vibe Coding平台的落地思考]]></title><link>https://blog.csdn.net/u013970991/article/details/166647020</link><guid>https://blog.csdn.net/u013970991/article/details/166647020</guid><author>u013970991</author><pubDate>Fri, 25 Sep 2026 22:19:11 +0800</pubDate><description><![CDATA[企业级AI编程正从“代码补全”迈向全流程智能化。Vibe Coding平台构建AI Software Factory，通过统一工作空间、多智能体编排、上下文工程与模型网关，实现需求拆解、编码、测试、评审、部署的闭环协同。其核心在于：以开发者习惯为入口，深度融合项目上下文，让AI理解架构、规范与历史，真正成为研发伙伴。上下文工程打通代码、文档、知识图谱与长期记忆，使大模型具备“读懂”复杂系统的认知能力；模型路由按需调度异构模型，在性能、成本与安全间取得平衡。这不仅是工具升级，更是研发范式的重构——让AI从“写]]></description><category></category></item><item><title><![CDATA[按下回车的瞬间，大模型到底在干什么？完整推理流程深度拆解]]></title><link>https://blog.csdn.net/u013970991/article/details/166601133</link><guid>https://blog.csdn.net/u013970991/article/details/166601133</guid><author>u013970991</author><pubDate>Thu, 24 Sep 2026 21:25:09 +0800</pubDate><description><![CDATA[按下回车后，大模型经历完整推理链：输入文本经分词器转为Token ID，嵌入层映射为高维语义向量，再通过多层Transformer进行自注意力计算与特征提取，利用KV Cache优化长序列效率。最终由线性层和Softmax生成候选词概率分布，结合采样策略（如温度、Top-K）决定输出内容。整个过程在数秒内完成上百亿参数的迭代，实现从自然语言到精准回答的跃迁。]]></description><category></category></item><item><title><![CDATA[KV Cache还能这么玩？解锁大模型推理降本提速的核心密码]]></title><link>https://blog.csdn.net/u013970991/article/details/166596427</link><guid>https://blog.csdn.net/u013970991/article/details/166596427</guid><author>u013970991</author><pubDate>Thu, 24 Sep 2026 16:33:46 +0800</pubDate><description><![CDATA[本文深入解析大模型推理中的核心优化技术——KV Cache，从实际应用场景出发，揭示其在减少重复计算、降低延迟与成本方面的关键作用。文章系统阐述了KV Cache的生成机制、显存占用瓶颈，并提出分层存储、硬件加速压缩（KV Shrink）、缓存融合（KV Fuse）与级联推理（KV Cascade）等创新方案，结合Intel至强平台软硬件协同能力，实现“以存代算”的高效优化，为AI应用高并发、长上下文部署提供可落地的基础设施升级路径。]]></description><category></category></item><item><title><![CDATA[读懂AI Infra，撑起大模型落地的幕后核心基建]]></title><link>https://blog.csdn.net/u013970991/article/details/166596179</link><guid>https://blog.csdn.net/u013970991/article/details/166596179</guid><author>u013970991</author><pubDate>Thu, 24 Sep 2026 16:25:16 +0800</pubDate><description><![CDATA[AI Infra已成为大模型时代的核心竞争壁垒，超越传统运维，贯穿训练、推理全生命周期。它通过优化通信、调度、数据管线与显存管理，实现算力高效利用，支撑千亿级模型稳定训练与低成本高并发推理。前沿方向如RL Infra、异构推理、超节点架构持续演进，推动算法落地商业化。其高复杂度、高风险、高价值特性，使岗位薪资远超普通开发，成为AI产业不可或缺的硬核工程底座。]]></description><category></category></item><item><title><![CDATA[深度拆解Claude Code多智能体协同架构，从单次委派到团队自治]]></title><link>https://blog.csdn.net/u013970991/article/details/166588789</link><guid>https://blog.csdn.net/u013970991/article/details/166588789</guid><author>u013970991</author><pubDate>Thu, 24 Sep 2026 13:36:28 +0800</pubDate><description><![CDATA[Claude Code通过分层多智能体架构解决AI编程中上下文冗余与任务协同难题。其SubAgent子智能体实现轻量化单次委派，通过独立上下文、单向通信与精简输出，彻底隔离中间日志，显著降低token消耗；支持自动、手动、编程三类触发方式，灵活适配代码审查、漏洞检测等原子任务。而Agent Teams则构建并行自治协作体系，支持多智能体协同开发、并行调试与跨模块协作，突破单一智能体瓶颈。双层架构兼顾效率与复杂工程需求，推动AI编程从“辅助工具”迈向“工程伙伴”。]]></description><category></category></item><item><title><![CDATA[Jev 架构启示，编码智能体的瓶颈藏在上下文组装里]]></title><link>https://blog.csdn.net/u013970991/article/details/166489668</link><guid>https://blog.csdn.net/u013970991/article/details/166489668</guid><author>u013970991</author><pubDate>Wed, 23 Sep 2026 18:09:36 +0800</pubDate><description><![CDATA[本文揭示编码智能体瓶颈不在大模型本身，而在于受制于KV缓存的追加式会话架构。该设计导致路由失效、工具臃肿、上下文膨胀、子任务难落地等六大问题。作者提出Jev决策层框架，通过显式状态管理与结构化决策，实现上下文按需加载、任务精准路由、工具高效调用，显著降低token开销。实证表明，真正生成代码的token占比不足10%，优化主战场应是检索与上下文管理。突破KV缓存“暴政”，重构执行框架，才是智能体体验跃迁的关键。]]></description><category></category></item><item><title><![CDATA[放弃自由生成文本，Jev凭什么让AI Agent和Codex跑得更快]]></title><link>https://blog.csdn.net/u013970991/article/details/166457634</link><guid>https://blog.csdn.net/u013970991/article/details/166457634</guid><author>u013970991</author><pubDate>Wed, 23 Sep 2026 09:41:09 +0800</pubDate><description><![CDATA[在大模型内卷加剧的背景下，TypeSafe推出的Jev模型打破传统生成式逻辑，以“不写文本、只做判断”为核心，通过三大判断原语（Choice、Noul、Score）实现高速、低成本的结构化决策。其摒弃自回归生成，采用并行推理与强化学习校准，响应延迟仅70-500毫秒，成本降低一个数量级。适用于日志分类、任务路由、风险评分等高频标准化场景，可显著提升AI Agent与Codex工作流效率。虽无“零幻觉”，但输出格式绝对可控，需配合代码校验使用。融合模式包括官方Skill工具包、分层调用与动态路由，助力轻量化智]]></description><category></category></item><item><title><![CDATA[刷屏全网的Jev模型深度解析，不写文案、不生成内容，却是AI落地的底层新基石]]></title><link>https://blog.csdn.net/u013970991/article/details/166338203</link><guid>https://blog.csdn.net/u013970991/article/details/166338203</guid><author>u013970991</author><pubDate>Tue, 22 Sep 2026 09:27:27 +0800</pubDate><description><![CDATA[很多文章只说 Jev 可以输出置信度，但没说清楚这个置信度到底有什么用、为什么重要、到底比普通模型强在哪。这里我从工程落地角度讲透 RLCD 决策校准的核心价值。普通大模型输出的结论是模糊的、不可量化的。它告诉你这是广告，你不知道它是百分百确定，还是猜的，还是幻觉出来的结果。工程系统最怕的就是这种模糊结论，机器无法判断该不该自动执行、该不该人工复核、该不该升级处理。Jev 采用的 RLCD 强化学习，核心目标不是提升文采、不是提升知识量，而是让模型的概率判断和真实准确率严格对齐。]]></description><category></category></item></channel></rss>