自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

Dawson Zhu的博客

FAB CIM engineer & github: https://github.com/BumbleBee-ZDS

  • 博客(156)
  • 收藏
  • 关注

原创 诚邀github开源书籍《AI在半导体晶圆厂的应用》contributer!!!

最近在编写一本开源书:《AI在半导体晶圆厂的应用》,写了第一版初稿,诚邀各路AI&半导体行业朋友作为contributer,学习之余补上这块空白。有兴趣的可以评论区留下邮箱or私我,拉你做contributer地址:https://github.com/BumbleBee-ZDS/Applications_of_AI_in_Semiconductor_Wafer_Fabs

2026-08-30 23:20:19 531

原创 《Agentic Design Patterns》第 10 章导读:模型上下文协议(MCP)

书中有个很形象的比喻:MCP 就像通用电源插座标准。在没有标准之前,每个电器都有自己的插头形状,你得为每个电器配一个专用插座——混乱、低效、扩展性差。有了标准插座之后,任何符合标准的电器都能直接插上去用,即插即用。MCP 就是 LLM 和外部系统之间的"通用插座"。它是一个开放标准,定义了 LLM(如 Gemini、GPT、Claude、Mixtral)跟外部应用、数据源、工具之间的通信方式。图 1:模型上下文协议(MCP)——LLM 与外部系统之间的标准化通信层。MCP 基于客户端-服务器架构。

2026-10-09 00:03:04 286

原创 《Agentic Design Patterns》第 9 章导读:学习与适应(Learning and Adaptation)

图 4:学习和适应模式——智能体通过经验自主改进行为与知识。智能体能不能自己变得更聪明?答案是:能,而且已经在发生了。SICA 自己改自己的代码、自己优化自己的工具;AlphaEvolve 自己发现更快的算法、自己优化 AI 的核心内核。这些都不是科幻,而是已经实现的事情。但兴奋之余,也有几个值得冷静思考的问题:第一个是对齐问题的放大。如果智能体有自我改进的能力,那它的目标对齐就变得极端重要。一个目标稍有偏差的智能体,经过多轮自我改进后,偏差可能会被放大到不可接受的程度。

2026-10-09 00:02:31 224

原创 《Agentic Design Patterns》第 8 章导读:记忆管理(Memory Management)

图 1:记忆管理设计模式——短期记忆维持当前对话,长期记忆跨会话积累知识。记忆管理这个话题,表面上看是"怎么存、怎么取"的技术问题,但往深了想,它其实关系到智能体的"自我"是什么。人类的身份感很大程度上建立在记忆之上——你之所以是"你",是因为你记得你经历过什么、你喜欢什么、你做过什么决定。如果一个智能体每次见到你都"失忆",那它对你来说就永远是个陌生人。从这个角度看,长期记忆不只是一个功能模块,它是智能体个性化的基础。有了它,智能体才能从"通用工具"变成"你的助手"。

2026-10-08 00:21:41 473

原创 《Agentic Design Patterns》第 7 章导读:多智能体协作(Multi-Agent Collaboration)

协作的核心是通信。智能体之间怎么交互、信息怎么流动,是多智能体系统设计的关键问题。书中梳理了六种典型的通信/组织模型,复杂度逐级递增:图 2:智能体通信与交互模型——从单智能体到自定义架构,复杂度逐级提升。1. 单智能体最基础的形态,自主运行,不跟其他智能体交互。好处是简单好管,坏处是能力天花板明显。适合可以独立完成的子任务。2. 网络(Network)多个智能体以去中心化方式点对点通信,共享信息、资源甚至任务。弹性好——一个挂了不影响全局。但问题是:大型网络的通信开销大,决策一致性难保证。

2026-10-08 00:19:59 369

原创 一块 1050Ti 学 AI Infra:我手搓了一个 LLM 网关,从 Redis 限流一路做到 nginx 负载均衡

AI Infra 不等于"训大模型"。在一台 1050Ti 笔记本上,我照样把工程里最难也最值钱的那部分练了一遍:限流怎么做才不会让一个用户拖死所有人、观测组件挂了服务要不要跟着死、多实例之间状态怎么共享、SSE 怎么才不被中间件缓冲、一个实例崩了用户为什么毫无感知、扩容到底该扩哪一层。这些能力换到任何一块 A100/H100 上都直接可用——只是数字会从 176 tok/s 变成 3000 tok/s,3 个实例变成 30 个实例。

2026-10-08 00:18:56 842

原创 FDE 前线部署工程师深度解析:AI 时代的新型技术角色

FDE(Forward Deployed Engineer),前线部署工程师,也有译作"前置工程师"或"现场工程师"。直接面对客户,同时亲手交付的软件工程师。第一,直接面对客户。FDE 不是躲在后方写代码的工程师,而是要冲到客户一线,和客户直接对话,理解他们的业务场景和痛点。他们需要听懂客户的业务语言,也需要能用客户能理解的方式解释技术方案。第二,亲手交付。FDE 不是只做方案设计和技术咨询,而是要动手写代码、搭系统、调参数,把方案真正落地。

2026-10-07 08:12:40 255

原创 《Agentic Design Patterns》第 6 章导读:规划(Planning)

给智能体一个目标,让它自己想出实现目标的行动序列。书里举了个很生活化的例子:你跟智能体说"组织一次团队外出活动"。你只说了目标是什么(活动内容、预算、参与人数这些约束),但完全没说怎么做。理解初始状态:预算多少、多少人参加、期望日期是什么;明确目标状态:成功预订一场大家满意的活动;设计行动序列:查场地 → 比价格 → 确认档期 → 订餐 → 发通知……关键在于,这个计划不是写死的,而是根据请求动态生成的。更重要的是,智能体还要能根据新信息调整计划——比如首选场地满了,它得自己找备选;

2026-10-07 00:02:51 304

原创 《Agentic Design Patterns》第 5 章导读:工具使用(Tool Use)

工具使用通常通过**函数调用(Function Calling)**机制实现。阶段做什么1. 工具定义向 LLM 描述外部函数的能力:用途、名称、参数及类型/描述2. LLM 决策模型结合用户请求 + 工具定义,判断"要不要调、调哪个"3. 函数调用生成若决定调用,模型输出结构化对象(通常是 JSON),注明工具名和参数4. 工具执行框架/编排层拦截这个结构化输出,真正执行外部函数5. 观察/结果工具的执行结果返回给智能体6. LLM 处理。

2026-10-07 00:02:39 479

原创 《Agentic Design Patterns》第 4 章导读:反思(Reflection)

与顺序链、路由那种"输出直接往下传"不同,反思引入了一条反馈循环:智能体不仅产生输出,还会回过头来检查它,找出改进空间,再基于这些洞察生成更优版本。执行:智能体执行任务或生成初始输出;评估/评审:通常靠另一次 LLM 调用(或规则集)分析上一步结果,从事实准确性、连贯性、风格、完整性、指令遵循度等维度打分;反思/优化:基于评审意见确定改进方向——可能产出优化输出、调整后续参数,甚至修改整体计划;迭代(可选但常见):继续执行优化后的结果,循环往复直到满意或达到停止条件。fill:#333;

2026-10-06 00:15:00 431

原创 《Agentic Design Patterns》第 3 章导读:并行化(Parallelization)

并行化指的是并发执行多个组件——可以是多个 LLM 调用、多次工具使用,甚至是整个子智能体。它不是"串行等待每一步完成再走下一步",而是让独立任务一起开工。搜索来源 A总结来源 A搜索来源 B总结来源 B基于摘要 A 和 B 合成最终答案同时搜索来源 A 和来源 B两个搜索完成后,同时总结来源 A 和来源 B合成最终答案(这一步通常仍需顺序执行,要等前面的并行步骤走完)找出那些不依赖彼此输出、可以齐头并进的环节,把它们并行掉。

2026-10-06 00:00:00 429

原创 《Agentic Design Patterns》第 1 章导读:提示词链(Prompt Chaining)

图 2:提示词链模式 —— 智能体从用户接收一系列提示词,每个智能体的输出作为链中下一个智能体的输入。提示词链是《Agentic Design Patterns》开篇的第一个模式,也是全书构建复杂 AI 智能体的"地基工程"。一次只让模型干好一件事。值得延伸思考的是,提示词链并非银弹。它的强项是"线性、有依赖"的任务流,这也意味着:如果各子任务之间没有强依赖、可以并行,那链条反而会拖慢进度(此时应考虑第 3 章的"并行化"模式);如果步骤太多,链的调试和审计成本也会上升。

2026-10-05 00:15:00 754

原创 《Agentic Design Patterns》第 2 章导读:路由(Routing)

路由把条件逻辑引入智能体的运行框架,让系统从"固定的执行路径"变成"动态评估标准、从一组可能动作中做选择"。它让系统变得更灵活、更有上下文感知能力。书里用一个客服智能体的例子讲得很清楚:带路由能力的智能体拿到用户查询后,会先对查询分类、判断意图分析用户的查询;基于其意图路由查询:意图是"检查订单状态" → 路由到与订单数据库交互的子智能体或工具链;意图是"产品信息" → 路由到搜索产品目录的子智能体或链条;意图是"技术支持" → 路由到访问故障排除指南的链条,或升级到人工;

2026-10-05 00:15:00 773

原创 Multi-Agent架构与适用边界:何时应该使用Multi-Agent架构

随着大语言模型(LLM)能力的持续演进,Multi-Agent(多智能体)架构逐渐成为解决复杂业务问题的热门技术方案。从 LangChain 的链式调用,到 AutoGen、CrewAI 的对话式多 Agent 协作,再到 LangGraph 的状态机图编排,Multi-Agent 框架经历了三代技术演进。然而,在实际工程落地中,盲目引入 Multi-Agent 往往导致系统复杂度飙升、延迟爆炸和 Token 成本失控。

2026-10-04 06:30:46 238

原创 AI时代,为何软件工程基础依旧重要?

在AI编程工具快速发展的背景下,一种观点认为"代码可以变得廉价",软件开发流程应当从传统的"设计-编码-测试"转向"规格描述-AI生成代码"的范式。然而,实践经验表明,这种观点忽略了软件工程中的若干基础原则。本文基于AI工程实践中的经验总结,系统梳理了GRIME需求澄清技能、普适语言(Ubiquitous Language)技能、测试驱动开发(TDD)作为AI反馈循环约束、以及深层模块(Deep Modules)接口设计委托法等实践方法,并分析了软件熵、设计概念等核心概念在AI辅助开发场景下的意义。

2026-10-04 06:30:29 282

原创 Agent上下文压缩的“状态保真“取舍框架解读

设 Agent 的原始上下文为Cc1c2cnCc1​c2​cn​,其中每个元素cic_ici​携带类型标签typecitypeci​和内容contentcicontentci​。压缩函数fff将原始上下文映射为压缩后的上下文C′C'C′C′fCC' = f(C)C′fC∀ci∈Skeepfcici(原样保留)

2026-10-03 00:03:05 333

原创 Cookbook Agent:拓扑Codebook方法与多Agent通信效率优化

需要多少个智能体(Agent)每个智能体扮演什么角色(Role)智能体之间如何建立通信连接(Topology)形式化地,协作拓扑可表示为有向图 G = (V, E),其中节点 V 表示智能体,边 E 表示通信路径。传统方法将拓扑设计视为在线优化问题,每次任务到来时重新搜索最优图结构,计算开销巨大。拓扑解空间实际上可以压缩为少量离散结构。类比"成衣定制"——与其每次量身裁缝(在线搜索),不如准备一套精选尺码库(Codebook),毫秒级即插即用。

2026-10-03 00:02:51 249

原创 大语言模型对齐与微调:原理解析与工程实践

当前大语言模型(LLM)的训练范式已形成一套相对成熟的四阶段流水线:预训练(Pre-Training, PT)、指令微调(Supervised Fine-Tuning, SFT)、偏好对齐(Preference Alignment)以及能力精化(Capability Refinement)。其中,PT阶段通过海量无标注文本学习语言统计规律与世界知识,是模型能力的基石;SFT阶段通过人工构建的指令-回答对赋予模型对话格式与指令跟随能力,是构建对话模型的关键环节;

2026-10-02 08:24:49 346

原创 智能体记忆系统:原理解析与工程实践

大语言模型(LLM)作为当前 AI 智能体的核心引擎,其上下文窗口(Context Window)的有限性始终是制约长周期、复杂任务执行的关键瓶颈。尽管模型本身的上下文容量在持续扩大(从 4K 到 128K 甚至更高),但"大海捞针"(Lost in the Middle)问题和上下文越长噪声越大的现象表明,单纯扩大窗口并非最优解。(以 MemGPT 为代表)、(以 GraphRAG、MemTree 为代表)以及(以 Mem-Alpha、Memory 2.1 为代表)。

2026-10-02 08:24:29 321

原创 AI Agent架构选型建议

随着大语言模型(LLM)能力的快速演进,AI Agent(智能体)已成为大模型落地的重要形态之一。与传统的对话式AI不同,AI Agent能够感知环境、主动进行决策并执行动作,通过调用外部工具逐步完成用户给定目标。然而,面对不同的业务场景复杂度与控制力需求,应当如何选择合适的Agent架构?

2026-10-01 00:19:03 376

原创 几何深度学习:原理解析与工程实践

几何深度学习(Geometric Deep Learning, GDL)是深度学习的一个重要分支方向,其核心目标是将数据中的几何结构(对称性)作为先验知识,通过群作用形式化地约束神经网络的设计,从而为卷积神经网络(CNN)、图神经网络(GNN)、Transformer、Deep Sets 等主流架构提供一个统一的数学理解框架。本文基于 Bronstein 等人于 2021 年发表的综述论文。

2026-10-01 00:18:49 643

原创 大模型推理的三维本质:原理解析与工程实践

大语言模型(LLM)的推理效率直接决定了其从实验室走向规模化部署的可行性。然而,工业界对推理瓶颈的认知长期停留在"GPU算力不够"的表层,忽视了推理阶段内在的结构性矛盾。本文基于对大模型推理阶段的系统性分析框架,从(自回归生成的马尔可夫链过程)、(Prefill与Decode两阶段交替的计算/访存异构性)和(KV Cache生命周期管理)三个维度,剖析推理性能瓶颈的根源,并梳理FlashAttention、PagedAttention、连续批处理、投机解码、权重量化等核心工程优化技术的原理与适用场景。

2026-09-30 00:06:03 296

原创 AI驱动的代码审查演进模型

代码审查(Code Review)是软件工程中保障代码质量的核心实践。随着大型语言模型(LLM)技术的快速发展,代码审查正在经历从"人工主导"到"AI 智能辅助"的范式转变。本文基于 IBM 提出的,系统梳理代码审查从 Fagan 检查法到 AI 智能审查的五个演进阶段,分析其核心方法论与工程实践要点,并结合业界最新实践(如 CodeRabbit、GitHub Copilot PR Review、BitsAI-CR 等)进行横向对比,最后对当前方法的局限性与未来方向进行客观评价。

2026-09-30 00:05:50 376

原创 一种多Agent权限管控与风险控制架构

随着大语言模型(LLM)驱动的 Agent 系统在企业级场景中的快速落地,多 Agent 协作架构的安全治理问题日益凸显。当系统中存在多个自主决策的 Agent 时,权限失控、工具滥用、跨租户数据穿透等安全风险呈指数级增长。本文系统梳理了一种基于三级权限分类、多租户沙箱隔离与全局监督 Agent 的分层安全机制,并从工程实践角度分析其设计思路、实现要点与局限性。在 Agent 规模化部署的背景下,传统基于提示词(Prompt)的安全约束方案已被证明不足以应对实际威胁。

2026-09-29 00:06:57 882

原创 Agent系统工程质量评估体系:原理解析与工程实践

Agent系统的工程质量可以从以下等式进行分解:用户可感知质量 = 模型能力(理解/推理/生成)+ 系统工程(编排/工具/记忆/权限/观测/测试/恢复)该等式揭示了一个关键事实:即使底层模型能力强大,如果系统工程(包括工作流编排、工具集成、记忆管理、权限控制、可观测性建设、测试体系和错误恢复机制)薄弱,最终用户感知到的质量仍然会很低。反之,优秀的系统工程可以在一定程度上弥补模型能力的不足。

2026-09-29 00:06:40 430

原创 多层技术领域本体构建:原理解析与工程实践

(5类):标签转移合理性、POS信息利用、特殊规则处理、数值与符号处理、概念完整性保证。

2026-09-28 00:02:14 452

原创 A2A 协议:面向异构智能体的互操作标准与工程实践

回到开头的问题——“A2A 协议是什么”,一个相对完整、能在面试或技术评审中站得住脚的回答是:A2A 是面向异构 AI Agent 的开放互操作协议。它通过Agent Card(能力发现)Task(有状态任务生命周期)Message / Part(多模态通信)Artifact(交付物)四个核心抽象,配合三种等价传输绑定,解决了不同厂商、不同框架 Agent 之间的发现、认证、委派、状态同步与结果交付问题。MCP 管 Agent 调用工具(纵向),A2A 管 Agent 之间协作(横向)。

2026-09-28 00:02:05 465

原创 Agent 工具调用出错怎么办:从防御到自愈的工程化实践

系统观:错误处理是一套闭环架构(事前—事中—事后),而不是单点代码;直面工程痛点:提前考虑死循环、副作用、回滚、成本等真实问题,并给出方案;善用 ReAct 原理:把报错信息转化为模型自我进化的动力,形成自修复闭环;平衡成本与效率:通过前端校验减少无效调用、通过反思机制降低重试次数,让每一次模型调用(Token 消耗)都更有价值。

2026-09-27 06:15:23 317

原创 长上下文中的位置偏差:Lost in the Middle 现象与 RAG 重排的工程实践

大模型的"长上下文能力"有两层含义——能装下(Context Window)≠ 能有效利用(Effective Utilization)。现象:答案放在上下文中间时,准确率比首尾低约 20+ 个百分点,呈 U 型曲线。根因:训练阶段的结构性位置先验 + 推理阶段的注意力稀释,叠加干扰文档导致的。对策:RAG 重排是最直接的工程解法——不仅要把答案"找出来",更要把它"放到模型看得见的位置"。态度:客观看待长上下文,不迷信上下文长度;通过评估、重排、Prompt 设计等手段主动管理位置偏差。

2026-09-27 06:15:04 321

原创 Agent 规划与执行分离架构的工程化设计:从职责解耦到四层防御

在实践中,"Agent 的规划与执行要不要分离"几乎是一个必答题。本文从经典的 Plan-and-Execute 模式出发,梳理职责解耦的核心动机、与 ReAct 的取舍边界,并在此基础上给出一套包含"蓝图校验—动作围栏—轨迹追踪—熔断止损"的四层防御体系,讨论每一层的职责、实现要点与常见误区。文中观点基于公开资料与个人工程实践整理,欢迎指正。

2026-09-26 00:01:34 294

原创 Agent 记忆系统设计:从向量检索到分层架构的工程实践

明确的属性用结构化档案保存,那么大段闲聊和长对话如何处理?答案在这一层。对于非结构化长对话,系统不会永久保存每一句原文,而是在后台自动提取主题与核心信息,浓缩成轻量化摘要清单——就像电视剧每集开头的"前情提要"。后续交互时,系统可直接把摘要注入上下文,使 Agent 承接之前的对话逻辑,无需重新检索全部原文。这既能大幅节省 Token,又能避免冗余信息干扰当前交互。技术背景补充:摘要生成通常借助模型本身(如用一个较强的模型对历史对话做summarize)或专门的抽取式摘要 pipeline。这是。

2026-09-26 00:01:18 289

原创 大模型结构化输出可靠性治理:从失效模式分析到分层防御体系

用Pydantic定义强类型模型,配合Instructor库,可自动完成生成 → 解析 → 校验 → 重试action: str = Field(..., description="枚举: send_email/search/none")recipient: EmailStr | None = None # 自动校验邮箱格式subject: str = Field(..., min_length=1) # 业务规则: 非空。

2026-09-25 00:14:58 303

原创 Agent 响应延迟优化:一套分层工程实践框架

Agent 响应延迟优化可归纳为四层协同│ 第四层 系统架构层 → 降低网络/基础设施延迟 ││ 第三层 Agent 编排层 → 减少交互轮次 ││ 第二层 上下文层 → 减少输入 token ││ 第一层 推理引擎层 → 提升吞吐(裸速度) │推理引擎层:推测解码、KV Cache、量化、动态批处理 → 提升裸吞吐;上下文层:前缀缓存、语义缓存、压缩、滑动窗口 → 减少输入;编排层:并行工具、模型路由、推测执行、流式 → 减少轮次、改善体感;架构层。

2026-09-25 00:14:40 299

原创 从柯尼斯堡七桥到多智能体编排:图工程的技术原理、收益与代价

Anthropic 在 2024 年底系统梳理的五种工作流模式,至今仍是设计图拓扑的主流范式 [citation:5][citation:10][citation:15][citation:20]。GVESδGVESδVVV:节点集合(每个节点 = 一个智能体 / 一个函数);E⊆V×VE⊆V×V:有向边集合(控制/数据流向);SSS:全局状态空间;δV×S→SδV×S→S:状态转移函数(对应节点执行 + 边路由)。属性含义。

2026-09-24 00:02:40 464

原创 RAG 文档切分策略全景解析:固定长度 vs 语义切分的技术权衡与工程实践

由斯坦福大学提出,ICLR 2024 发表[citation:9]。核心思想:将切好的块一层一层做聚类+摘要,长成一棵"摘要树"。构建流程叶子层:原始文档块(细粒度)聚类:用 K-Means / 层次聚类将语义相近的块聚合摘要:LLM 为每个聚类生成高层摘要(父节点)递归:将摘要再次聚类、摘要,直到根节点检索方式:从根节点开始自上而下遍历,宏观问题命中上层摘要,细节问题一路向下到叶子[citation:3][citation:12]。效果:在 QuALITY 基准上,配合 GPT-4 最佳性能提升。

2026-09-24 00:02:30 477

原创 Agent 评测集构建的工程化路径:从零数据到可持续迭代的评测体系

在 Agent 项目即将上线、手里却没有一条人工标注数据的场景下,工程师最常给出的方案是:“让大模型批量生成一千道题,再让模型自己判分。这个方案的问题不在于"用模型",而在于把模型同时放在了出题人、答题人、裁判三个位置上。自导自演产生的同质化样本,会让评测分数虚高——跑出接近满分的成绩,上线后却被真实用户投诉。这不是评测,这是自我安慰。

2026-09-23 00:05:37 430

原创 .env 文件与环境变量管理:原理、实践与常见误区

在几乎所有现代项目——无论前端、后端、运维还是移动端——的根目录里,我们都可能看到一个以.env。它体量很小,却承担着「项目配置中枢」的角色。然而围绕它,社区里一直存在一些误解:有人把它当成「存放所有配置的万能抽屉」,有人误以为它就是环境变量的全部,还有人因为误提交真实.env到公开仓库而导致密钥泄露。本文从.env的本质讲起,梳理它的工作机制、典型用法、安全边界与常见误区,力求给出一套可落地、不偏激的实践建议。理解.env,本质上是理解**「配置与代码分离」**这一软件工程基本原则。

2026-09-23 00:05:25 382

原创 Jev 爆火之后,我们真正该重新想想 Agent 到底该怎么“下决定”

事件或用户输入↓开放模型:解释、改写、组织证据↓状态构造与上下文筛选↓受限判断模型:Choice / Score / Noul↓确定性策略引擎:权限、阈值、预算↓自动执行 复核或强模型 人工或拒绝↓审计、回放、漂移与校准更新模型输出只是策略引擎的一项输入。真正决定要不要执行动作的,还包括权限、状态、预算、审计和回滚机制。自然语言依然很重要,只是位置变了。它适合定义语义、处理长尾、协商异常和复盘事故;结构化消息适合承担稳定、高频、能够自动验证的流程。两者不是替代关系,而是分工关系。

2026-09-22 00:02:04 734

原创 从 Jev 说起:快慢模型如何协同调度,以及这背后需要解决什么问题

近期 TypeSafe AI 的 Jev 模型引起了不少关注。它不做自回归文本生成,而是给定状态与一组预定义问题,一次前向输出的概率分布与置信度,端到端 70–500 ms。这个变化看似只是「更快更便宜」,实际上改变的是——概率可以直接参与计算,而文本必须经过解析才能变成数字。本文从这一处差异出发,记录一条由浅入深的推导路径。Null只保证不输出选项之外的内容,不保证判断正确,因此「零幻觉」是格式性质而非判断性质。

2026-09-22 00:01:58 711

原创 大模型 Agent 记忆系统五大技术路线解析与工程选型指南

Text2Mem 的定位不是"又一个记忆数据库",而是一套记忆系统通用操作协议。它试图在大模型和底层存储之间增加一层中间表示层 IR,把用户自然语言指令翻译成类似 CPU 指令集的原子操作。维度Text2MemMem0LettaRMMMEMU核心理念记忆操作协议中间件虚拟内存文件即记忆主动守护进程记忆存储SQLite 参考实现多存储引擎适配Markdown + 向量数据库 + 虚拟文件系统驱动方式被动指令被动读写被动 + 睡眠反思被动主动预测安全与审计。

2026-09-21 00:02:43 500

AI agent四层记忆架构实践,治疗大模型"金鱼脑"

AI agent四层记忆架构实践,治疗大模型"金鱼脑"

2026-08-09

具身智能进晶圆厂的技术拆解:从SEMI标准、振动抑制到云边端调度

具身智能进晶圆厂的技术拆解:从SEMI标准、振动抑制到云边端调度

2026-08-09

半导体智能制造实践:晶圆厂世界模型构建与落地全解析2.0

半导体智能制造实践:晶圆厂世界模型构建与落地全解析2.0

2026-08-09

半导体智能制造实践:晶圆厂世界模型构建与落地全解析1.0

半导体智能制造实践:晶圆厂世界模型构建与落地全解析1.0

2026-08-09

半导体制造AI大脑-AI Agent:从CIM 1.0到CIM 3.0的跃迁

半导体制造AI大脑-AI Agent:从CIM 1.0到CIM 3.0的跃迁

2026-08-09

Palantir Ontology 如何重塑半导体晶圆厂:从数据孤岛到业务操作系统

Palantir Ontology 如何重塑半导体晶圆厂:从数据孤岛到业务操作系统

2026-08-09

基于Palantir Foundry构建半导体制造AI友好型数据中台:从良率分析场景谈起

基于Palantir Foundry构建半导体制造AI友好型数据中台:从良率分析场景谈起

2026-08-09

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除