自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(100)
  • 收藏
  • 关注

原创 《PyTorch》Transforms:数据增强不是锦上添花,是训练基本功

• Transforms 是数据进入模型前的加工车间。• 预处理让输入规范,数据增强让模型泛化。• 训练集可以随机,验证/测试集必须稳定。• v2 transforms 适合复杂任务,可以同步处理 image、box、mask、video。• 源码主线是 Dataset → Compose → Transform.forward → make_params → transform → functional → kernel。

2026-06-16 12:43:02 461

原创 《PyTorch 深度修炼》Dataset 和 DataLoader:数据如何喂给模型

• Dataset 解决“一个样本怎么取”。• DataLoader 解决“样本如何成批、高效、稳定地送进模型”。• Sampler 管顺序,BatchSampler 管批次,collate_fn 管拼接。• num_workers 能提升吞吐,但也会带来进程、内存和 IO 成本。• IterableDataset 多进程要特别注意分片,否则容易重复读数据。• pin_memory 是 GPU 训练的数据搬运优化点,但自定义 batch 需要自己适配。

2026-06-16 08:27:45 435

原创 《PyTorch 深度修炼》优化器:参数到底是怎么被更新的

优化器是训练闭环里真正修改参数的组件。SGD 简单直接,适合追求可控和泛化。Momentum 用历史方向减少震荡。Adam 用一阶矩和二阶矩给每个参数自适应步长。AdamW 把 weight_decay 从梯度更新里解耦出来,是 Transformer 和大模型训练里的常见默认选择。源码上,Optimizer 管理 param_groups 和 state;具体 step 收集 grad 和状态,再下沉到 functional 与底层算子。

2026-06-15 22:36:39 370 1

原创 《PyTorch 深度修炼》损失函数:模型到底是怎么知道自己错了

Loss 是训练目标。你怎么定义 Loss,模型就怎么学习。回归任务先看 MSELoss、L1Loss、HuberLoss。多分类默认用 CrossEntropyLoss,直接输入 logits。二分类和多标签默认用 BCEWithLogitsLoss,直接输入 logits。源码上,Loss 类本质仍然是 nn.Module,forward 通常下沉到 torch.nn.functional,再进入 C++/ATen kernel。

2026-06-15 21:55:24 475

原创 常用网络层:Linear、Conv、RNN、Embedding、Transformer

Linear、Conv2d、LSTM、Embedding、Transformer,不是五个孤立 API。它们是一套特征变换语言。你真正要记住的是它们各自处理什么结构、改变什么形状、源码最终调到哪里。

2026-06-15 15:03:51 258

原创 PyTorch 系列 之 nn.Module:所有模型的骨架

nn.Module 是 PyTorch 模型的骨架。它把散落的层、参数、状态组织成一棵可训练、可迁移、可保存、可调试的树。掌握 Module,后面讲 Linear、Conv、Transformer、训练循环、模型保存、分布式训练,都会有同一套底层语言。PyTorch 系列 之 nn.Module:所有模型的骨架:功能变化与行业影响解析_热闻岛。

2026-06-15 12:30:51 303

原创 动态图机制:为什么 PyTorch 调试起来更舒服

动态图的本质:Python 负责真实执行,Autograd 负责记录历史,Engine 负责反向回放。PyTorch 调试舒服,不是偶然。它的默认执行方式就是按普通 Python 程序来跑。动态图让模型更自由,也让错误更接近代码现场。但自由有代价。性能优化、部署和跨平台推理,需要把动态图中的稳定部分重新抽成图。这正是后续 torch.compile、torch.export、ONNX 要解决的问题。动态图机制:为什么 PyTorch 调试起来更舒服:功能变化与行业影响解析_热闻岛。

2026-06-15 07:24:20 571

原创 Autograd 自动求导:PyTorch 训练模型的发动机

Autograd 是 PyTorch 训练的发动机。requires_grad 决定是否记录计算。grad_fn 指向反向图入口。backward 从 loss 出发反向遍历。叶子 Tensor 的 .grad 会被填充。中间节点的梯度默认不保留。某些算子会保存前向中间值,用于反向计算。Python API 负责入口,C++ Autograd Engine 负责真正执行。一句话:前向建图,反向执行,梯度累加,优化器更新。

2026-06-14 20:40:41 369

原创 PyTorch之Tensor 内存机制:为什么 contiguous 很重要

以后你看到 Tensor 变形,不要只看 shape。真正要看的是:• 它底层是不是同一块 Storage?• 它的 stride 有没有变?• 它是不是从 storage_offset 开始读?• 它的逻辑顺序和物理顺序是否一致?• 这一步到底是零拷贝,还是偷偷复制了新内存?PyTorch 的 Tensor 很灵活,也很容易误用。你理解了 Storage、Stride、Offset,就真正摸到了 Tensor 的底层骨架。

2026-06-14 15:18:55 300

原创 Tensor:PyTorch 世界里的一切都是张量

Tensor 是 PyTorch 的第一块地基。学 PyTorch,不要先背 API。先理解 Tensor 的本质。它不是数组。它是“数据 + 元信息 + 设备 + 内存视图 + 梯度能力”的组合体。shape 决定外形。dtype 决定数值格式。device 决定计算位置。stride 决定如何读内存。storage 保存真实数据。requires_grad 决定是否进入自动求导。

2026-06-14 10:47:01 348

原创 环境安装与开发姿势:CPU、CUDA、ROCm、MPS 怎么选

• 第一,先选硬件后端,再复制安装命令。• 第二,CPU 版最稳,CUDA 版最主流,ROCm 要看兼容,MPS 适合 Mac 本地调试。• 第三,安装成功不等于 GPU 可用,必须用代码验证。• 第四,is_available 返回 False 时,优先排查 wheel、驱动、设备可见性。• 第五,显存和 CUDA 报错有异步与缓存机制,不能只看表面。下一章开始进入 PyTorch 的真正核心:Tensor。Tensor 是所有模型、梯度、参数和计算图的起点。

2026-06-14 09:23:08 598

原创 PyTorch 到底是什么?为什么它能成为深度学习主流框架

记住 5 句话。✓PyTorch 的核心数据结构是 Tensor。✓训练能跑起来,靠的是 Autograd 自动求导。✓模型能被组织起来,靠的是 nn.Module 的注册机制。✓速度能上去,靠的是底层 C++ / ATen / 设备后端。✓PyTorch 好用,是因为它把 Python 友好性和底层高性能结合在了一起。下一章,我们开始进入第一个硬核组件:Tensor。你会看到 Tensor 不只是数组,它背后还有 dtype、device、stride、storage 和内存布局。

2026-06-14 08:46:44 495

原创 SkyClaw-v1.0 发布:国产百万上下文 Agent 模型,能不能替代 Claude Code?

SkyClaw-v1.0 最值得关注的地方,不是“又一个国产大模型发布”,而是它把目标直接对准了 Agent Coding 的关键环节:长上下文、多轮工具调用、文件编辑、代码生成、测试执行和真实任务闭环。通俗讲,以前很多模型更像“会写代码片段的高手”,你问它一个函数,它给你一段答案;但真正的 AI Coding 不是写一段函数,而是接到一个需求后,能自己看仓库、找文件、改代码、跑测试、看报错、继续修,最后交出一个可以审查的 diff。

2026-05-27 22:19:13 570

原创 融资 700 亿传闻背后,DeepSeek Code 真要来了吗?

很多人使用大模型写代码时,会有一种错觉:模型越强,AI 编程工具就越强。实际不是这样。裸模型只负责“推理与生成”,但真实开发需要面对文件系统、命令行、Git、依赖、测试、权限、安全、回滚、团队协作。中间这层把模型能力连接到真实开发环境的系统,就是 Harness。可以把它理解成:模型是大脑,Harness 是眼睛、手、工具箱、记事本、规则册和安全绳。没有 Harness,模型只能告诉你“应该怎么改”;有了 Harness,它才可能亲自读取文件、定位问题、修改代码、运行测试,并把结果交还给人审查。

2026-05-27 19:10:02 633

原创 AI编程工具:Claude Code、Codex、Cursor、OpenCode之间的区别

OpenCode 则走开源、多模型、可控路线。如果说上一代工具更像“随叫随到的代码提示器”,那么现在的 Claude Code、Codex、Cursor、OpenCode 更像“能进入项目现场的开发助理”。真正要落地,需要把工具放进研发治理体系里:权限、沙箱、审计、CI、评估、成本、合规一个都不能少。Claude Code、Codex、Cursor、OpenCode 的出现,说明 AI 编程已经进入新的阶段:它不再只是“帮你补一行代码”,而是开始参与需求理解、代码修改、测试验证、PR 交付和团队协作。

2026-05-26 10:52:43 1095 1

原创 别再只看排行榜了:一套真正能上线的 AI 评估体系,应该这样设计

AI评估不是为了证明模型有多厉害,而是为了回答三个上线问题:能不能稳定完成任务?出错时能不能被发现?每一次模型、提示词、检索和工具链变更,会不会把线上效果带崩?

2026-05-25 11:39:59 717

原创 飞书秒变 Claude Code 控制台:一个 Bridge 项目,正在改写 AI 编程入口

过去我们谈 AI 编程,第一反应是 IDE 插件、终端工具、命令行 Agent。但这个飞书 + Claude Code Bridge 的价值在于,它把 Agent 带到了开发者每天高频使用的协作界面里。它的技术难点并不神秘:WebSocket 接事件、子进程调 Claude CLI、解析 stream-json、更新飞书卡片、管理 session 和 workspace。真正有价值的是组合方式:把这些普通模块拼成了一个更自然的工作入口。第一,它改变了入口。

2026-05-23 21:14:10 948

原创 国家发改委点名具身智能训练基础设施:机器人为什么要从赛场跑向工厂、商场和家庭?

过去几年,大模型让 AI 具备了很强的理解、生成、推理能力。但多数大模型仍然主要活在数字世界里:你输入文字,它输出答案;你输入图片,它输出描述;你输入需求,它生成代码或方案。具身智能不同。它强调 AI 必须绑定一个“身体”,比如人形机器人、机械臂、四足机器人、轮式机器人、无人车等。这个身体有摄像头、雷达、触觉、关节、电机、执行器,能够感知环境、理解任务、做出动作,并从真实物理反馈中学习。这意味着具身智能比聊天机器人更难,因为真实世界不会像文本一样规整。

2026-05-22 23:00:27 576

原创 AI 应用开发到底在开发什么?

最后用一句话总结:AI 应用开发不是单纯开发模型,而是开发一个能让模型在业务里安全、准确、稳定工作的系统。具体来说,它主要开发 5 件事:• 开发入口:让用户用自然语言、文件、图片、语音和系统交互。• 开发数据:把企业知识、业务数据、文档资料变成模型可用的上下文。• 开发编排:决定什么时候走 RAG,什么时候走 Agent,什么时候走固定工作流。• 开发工具:把企业已有接口封装成模型可以安全调用的能力。• 开发保障:让 AI 应用具备权限、日志、评测、监控、成本控制和兜底能力。

2026-05-22 21:52:39 528

原创 OpenHuman 两日破万星背后:AI Agent 开箱即用、本地记忆、隐私安全与个人数字分身全解析

OpenHuman 的走红,不应该简单理解成又一个开源项目爆火。它真正代表的是个人 AI Agent 的产品逻辑正在改变:过去比谁插件多、谁模型强、谁自动化更猛;现在开始比谁更容易上手、谁更懂个人上下文、谁更尊重隐私、谁更能长期稳定地融入日常生活。OpenClaw 证明了多渠道网关和插件生态的价值,Hermes 证明了学习闭环和技能进化的价值,OpenHuman 则把问题推向了更大众的一侧:普通人能不能不折腾、不养成、不反复解释背景,也拥有一个真正懂自己的 AI 伙伴。

2026-05-21 13:17:40 648

原创 Qwen3.7-Max深度解析:智能体Agent、AI编程、MCP工作流、跨框架泛化与百炼API,一次讲透国产大模型新前沿

所谓“智能体基座”,可以理解为支撑各种智能体应用的核心模型。上层可以是编程助手、办公助手、数据分析助手、客服助手、运维助手,也可以是一个由多个子智能体组成的团队。底层模型必须足够稳,才能让这些上层应用跑起来。普通模型更像一个知识问答接口:你问一句,它答一句。智能体基座则更像一个大脑中枢:它要分配任务、连接工具、读取反馈、修正策略、控制成本,还要在必要时把复杂任务交给不同角色协作完成。Qwen3.7-Max 的重点,不是又多了一个会聊天的大模型,而是说明大模型竞争正在进入智能体执行时代。

2026-05-20 22:47:32 687

原创 MSE AI任务调度爆火:Agent定时任务、Dify、OpenClaw、Hermes、百炼统一调度,如何把AI助手变成自动干活的数字员工?

这次值得关注的点,不是“又多了一个定时任务功能”,而是 Agent 正在从一个交互工具,变成可以被组织、被管理、被观测、被审计、被优化的数字劳动力。MSE AI任务调度解决的核心问题,可以概括为五句话:让 Agent 不再等人手动触发,而是按时间、事件和规则自动运行。让分散在不同框架里的 Agent,被统一接入、统一管理、统一观测。让任务失败、超时、无可用执行器等异常可以被及时发现和处理。让权限、配额、日志、审计和成本控制成为标准能力。

2026-05-20 22:27:04 602

原创 AI Agent 构建实战:Claude Code 模式迁移、Rust 代码审查 Agent、六层架构与工程闭环全解析

资料选择了一个非常适合练手的场景:输入一份 Git diff,输出一份结构化代码审查报告。这个场景很典型,因为它天然覆盖了 Agent 构建的六个关键维度。第一,它需要读取变更内容,所以一定会遇到上下文预算问题。第二,它需要搜索关联文件,所以一定会涉及工具编排。第三,它要判断 bug、安全风险和设计问题,所以需要稳定的提示词控制。第四,它只能审查,不能乱改,所以要有权限边界。第五,模型调用和工具调用都可能失败,所以要有重试和熔断。第六,审查结果要可追踪,所以要有日志、指标和报告结构。

2026-05-20 07:59:47 609

原创 Claude Code 可观测性工程爆火全解析:AI Agent 日志、遥测、追踪、成本监控与安全治理一次讲透

很多遥测数据不是在运行中丢的,而是在退出时丢的。用户按下 Ctrl+C、终端关闭、进程收到信号、系统回收资源,如果关闭流程没有设计好,最后几秒最关键的数据就可能没机会写入。优雅关闭要有明确优先级:先恢复终端状态,再保存会话和本地状态,再执行收尾 Hook,最后刷新遥测。每一步都要有超时,不能让某个环节无限等待。这类设计看似细节,却决定了系统在异常边界上的质量。生产级工具不是只在正常路径上好用,也要在退出、崩溃、取消、断网时尽量可恢复。真正成熟的 AI Agent,一定不是一个只会调用模型的黑盒。

2026-05-19 22:00:48 359

原创 Claude Code 不足复盘与容错架构全解析:AI Agent 架构优化、上下文工程、缓存稳定性、LSP 语义搜索、Feature Flag 治理

长会话一定会遇到上下文窗口限制。自动压缩的价值很明显:把前面的对话、文件操作、命令结果、技术决策压成摘要,让 Agent 能继续工作。但压缩天然是有损的,尤其是用自然语言摘要时。最容易丢的不是“最后做了什么”,而是“为什么这样做”。比如模型尝试过方案 A,失败后改用方案 B。压缩后可能只剩“采用方案 B 解决问题”,失败方案 A 和当时的判断过程就消失了。下一轮模型可能又重新尝试 A,造成重复踩坑。还会丢失精确引用。

2026-05-19 16:39:41 490

原创 AI Agent 生产级编码模式全解析:Claude Code 八大工程模式,读懂智能编程、权限安全、上下文治理与工具系统

八大模式看起来并不玄:先读再改、渐进自主、防御 Git、结构验证、范围匹配、工具级提示、结构化搜索、能力降维。它们甚至没有高深数学,也没有神秘技巧。但正是这些朴素规则,让 AI 编程助手从“能演示”走向“能交付”。真正的差距,不在于谁写了更长的提示,而在于谁把提示变成了工具边界、权限梯度、验证链路、搜索协议、缓存策略和降维路径。模型负责生成可能性,工程系统负责把可能性约束成可靠动作。

2026-05-19 13:29:44 380

原创 Claude Code 驾驭工程原则全解析:AI Agent、上下文工程、Prompt Cache、权限安全、A/B测试、长期记忆与多智能体架构底层方法论

这份材料最值得反复品味的一句话可以概括为:控制行为的最佳方式,不是写更多代码,而是设计更好的约束。提示词即控制面,让行为可调整;缓存感知设计,让长上下文成本可控;失败关闭,让默认状态更安全;A/B 测试,让行为变更有数据依据;先观察再修复,让问题定位更可靠;锁存以求稳定,让系统避免抖动。六条原则背后,其实是一种工程哲学:AI Agent 不是“放任模型自由发挥”,也不是“用代码把模型绑死”,而是在模型能力和工程约束之间建立一套稳定的驾驭系统。

2026-05-19 08:41:56 593

原创 Claude Code Feature Flag 未发布功能管线全解析:89 个开关看懂 AI Agent 后台自主运行、Auto Mode、远程执行与上下文工程

从这组 Feature Flag 可以看出,AI 编码工具的下一阶段,绝不是多加几个按钮那么简单。它正在走向后台持续运行、多 Agent 协作、远程环境执行、智能权限审批、上下文精细治理、团队记忆沉淀和多模态交互。

2026-05-18 21:33:01 338

原创 Claude Code 插件系统全解析:AI Agent 扩展生态、Marketplace、权限治理、企业级平台化关键技术

插件数量多并不代表生态成熟。真正成熟的插件系统,一定要同时回答五个问题:能力怎么表达,来源怎么分发,版本怎么控制,风险怎么审计,企业怎么治理。对于 AI Agent 来说,这比传统软件插件更重要。因为插件影响的不只是界面,而是模型可以调用的工具、可以参考的技能、可以触发的自动化、可以连接的外部系统。插件系统本质上是在定义 Agent 的“运行时能力边界”。未来的 AI 编码工具,可能不会只比拼谁的模型更强,而会比拼谁的扩展生态更安全、更可组合、更容易被企业接受。能把能力做成插件,只是第一步;

2026-05-18 20:04:11 497

原创 Claude Code 技能系统全解析:AI Agent 自定义能力、SKILL.md、MCP 扩展、上下文预算与企业级自动化落地

用户自定义技能是整个系统最有想象力的部分。个人可以把常用写作、代码审查、数据处理、发版检查沉淀成技能;团队可以把项目规范、组件库约束、接口风格、测试要求写进仓库;企业可以通过策略管理,把审计过的技能统一下发。技能系统真正厉害的地方,不在于多了一个命令入口,而在于它提供了一种把经验、流程、规范、权限、上下文预算和自我改进统一起来的工程抽象。对于个人,它能减少重复提示,让 AI 更懂你的工作方式;对于项目,它能把仓库规范沉淀成可执行流程;对于企业,它能把可审计的能力统一分发,并通过权限和信任边界控制风险。

2026-05-18 13:15:05 655

原创 Claude Code Ultraplan 远程多代理规划全解析:AI Agent、CCR远程容器、异步规划、状态机、计划传送与企业级自动化治理

Ultraplan 真正值得关注的地方,不是它把计划放到远程执行,而是它把“计划”这件事做成了完整工程能力:入口可感知、启动可校验、远程可运行、状态可轮询、审批可分支、失败可归档、策略可实验、结果可迁移。这说明 AI 编程工具正在从“单轮问答”走向“异步任务系统”。未来的 AI Agent 不只是回答问题,而是会像一个分布式工作流平台:能派生任务、并行探索、远程执行、等待审批、失败恢复、生成交付物。

2026-05-18 08:29:52 625

原创 Claude Code Agent Teams 多进程协作全解析:Swarm、TaskList、Mailbox、AI Agent 并行调度与工程落地

Agent Teams 的关键启发可以用一句话概括:让每个 Agent 拥有独立上下文,同时让它们围绕共享状态协作。独立上下文解决的是容量问题。每个队友可以专注一个方向,不必把所有中间过程塞进负责人对话里。共享状态解决的是协作问题。任务表告诉队友该做什么,Mailbox 让队友能交流,事件面让系统能续跑,权限同步让安全不失控。所以,真正的多 Agent 工程不是“多几个模型并发调用”,而是把组织结构、任务依赖、消息通信、权限审批、记忆共享、异常恢复和后端适配做成一个可靠运行时。

2026-05-17 19:00:35 551

原创 AI Agent多智能体编排爆款解析:Claude Code Subagent、Fork、Coordinator、Bridge远程执行与安全治理全拆解

单个 Agent 像一个能力很强的工程师,但复杂项目不是靠一个人闭门完成的。真正可落地的 AI 编程系统,需要探索者、实现者、验证者、协调者、远程执行器共同工作。Subagent 解决上下文污染,Fork 解决完整现场下的并行探索,Coordinator 解决复杂任务调度,Verification 解决质量兜底,Bridge 解决远程触发与本地执行。它们组合起来,才构成一个可扩展、可审计、可恢复的 AI Agent 工程体系。

2026-05-17 17:06:09 567

原创 Claude Code CLAUDE.md 用户指令覆盖层全解析:AI Agent 记忆系统、上下文工程、规则分层、团队协作与安全治理

CLAUDE.md 的真正价值,是把 AI Agent 从“每次从零开始聊天”,推进到“带着项目长期记忆工作”。它让团队规范、个人偏好、项目结构、安全要求可以稳定进入模型上下文,让 Agent 不再每次都靠临场理解。但它也提醒我们:未来 AI Agent 的竞争力,不只是模型参数,也不是某一句神奇提示词,而是一整套上下文工程能力。谁能把规则分层、按需加载、控制预算、追踪来源、处理冲突、配合权限与沙箱,谁就更容易把 Agent 用进真实生产环境。

2026-05-17 15:42:03 556

原创 Claude Code 沙箱系统全解析:Seatbelt、Bubblewrap、AI Agent 安全隔离、权限治理与企业级防护

Claude Code 沙箱系统最值得学习的地方,在于它不是单点功能,而是一套完整控制平面:平台适配负责跨系统运行,配置优先级负责治理,文件隔离负责保护本地资产,网络隔离负责防外泄,Bash 决策链负责执行前判断,执行后清理负责切断残留攻击链,企业策略负责把安全要求固化下来。把这套思路抽象出来,可以得到一个非常清晰的结论:AI Agent 越自主,越需要硬边界;越能执行真实命令,越不能只靠提示词;越要进入企业生产环境,越必须具备配置锁定、审计、白名单和失败保护。

2026-05-17 13:56:34 835

原创 Claude Code Hooks 用户自定义拦截点全解析:AI Agent 自动化、安全治理、插件扩展、可观测性核心机制

Hooks 的本质,不是给 Agent 加几个回调,而是给 Agent 加一套工程控制层。它让工具执行可拦截,让用户输入可过滤,让模型停止可复核,让子 Agent 可追踪,让上下文压缩可观测,让企业策略可落地。如果说提示词决定 Agent 的行为倾向,那么 Hooks 决定 Agent 的行为边界。一个成熟的 AI 编码系统,不能只依赖模型自觉,而要把关键动作变成可执行、可审计、可回滚、可阻断的工程流程。

2026-05-17 10:02:59 597

原创 AI Agent 提示注入防御全解析:Unicode 清洗、MCP 安全、Claude Code 权限治理与纵深防御

提示注入防御的核心,不是把所有外部数据拒之门外,而是在连接外部世界时,给 Agent 建立可靠边界。因为 Agent 要创造价值,就必须读文件、查资料、用工具、连系统;但只要它连接外部系统,就会遇到被污染、被伪装、被诱导的上下文。一套好的防御体系至少要做到四点:看不见的字符要清洗,容易伪造的结构要转义,不同来源要打标签,高风险动作要人工确认。再加上模型层警觉和行为边界,才能把风险压到可控范围。

2026-05-16 22:01:59 474

原创 Claude Code 权限系统全解析:AI Agent 安全治理、权限模式、规则匹配、沙箱防护与企业落地实战

AI 编码助手的发展方向越来越清晰:它会越来越能干,能读更多文件,能执行更多命令,能处理更复杂的任务。但越是强大的 Agent,越需要更成熟的权限系统。真正可靠的设计,不是让用户在安全和效率之间二选一,而是通过模式、规则、管线、沙箱、路径验证、分类器和审计系统,把不同风险级别的动作分层处理。一句话总结:未来的 AI Agent 工程能力,不只看模型有多聪明,更要看权限边界有多清楚、自动化过程有多可控、安全事件有多可追溯。

2026-05-16 20:02:45 557

原创 Claude Code 缓存优化模式全解析:AI Agent 上下文工程、Prompt Cache、工具 Schema 缓存、Token 成本优化

把这些模式放在一起看,会发现它们不是零散技巧,而是一条固定决策链。遇到动态内容,优先判断能不能后移;不能后移,再看能不能标准化;无法标准化,就降低变化频率;再不行,就用预算限制变化幅度。这条链路可以应用到任何 AI Agent 系统中:日期、路径、用户配置、工具列表、插件列表、权限说明、外部服务状态、模型开关,都可以按这套方法审计。Claude Code 的缓存优化模式给 AI Agent 工程带来一个非常重要的启发:成本优化不是最后做的运维工作,而应该前置到架构设计阶段。

2026-05-16 18:37:52 631

原创 Claude Code Prompt Cache 缓存中断检测系统全解析:AI Agent 上下文工程、可观测性、成本优化与性能治理

Prompt Cache 能省钱、提速,但它也带来一个新问题:缓存什么时候断、为什么断、该不该报警。没有检测系统,缓存就像一个黑盒,只有账单和延迟告诉你它可能出事了。Claude Code 的缓存中断检测系统给出的答案,是建立一套两阶段可观测性架构:请求前记录状态快照,响应后根据 token 统计确认中断,再用变化清单、TTL 判断、服务端归因、日志、事件和 Diff 文件形成完整诊断链。

2026-05-16 17:16:12 554

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除