- 博客(78)
- 资源 (6)
- 收藏
- 关注
原创 大白话讲解Addy Osmani 的循环工程Loop Engineering工作流
<think>好的,用户需要根据一篇长文生成一篇摘要,字数要求在150字以内。内容是讲AddyOsmani的“循环工程”工作流。 核心概念是用loop+goal构建自动化闭环,关键点是:评估是命门、需要机器可验证的目标、任务可委托但品味和判断要自己核。用户要求“大白话讲解”,所以我要用直白的语言,不能太抽象。 摘要不需要覆盖所有细节,要抓核心框架和最有价值的观点。范围限制是150字以内,需要精简。</think>循环工程的核心:把“重复盯着”的苦差事交给AI。先定下能由机器检查的目标
2026-09-03 20:32:11
419
原创 干货:11 个 AI Agent 小窍门,建议收藏
<think>我们需要理解任务:用户提供了一段长文本,内容是关于ColeMedin的视频笔记,总结了11个CodingAgent修复技巧。要求:“根据以下内容,生成≤150字的文章摘要”。这意味着我们需要基于提供的文本,生成一个不超过150字的摘要。需要简洁概括核心内容。注意:要中文摘要。原文很长,我们需要提炼出最核心的信息。用户明确说“根据以下内容”,因此摘要应覆盖主要观点,但受字数限制,需高度概括。 先分析内容:标题(隐含)是ColeMedin的11个微小CodingAgent修复。文章分六
2026-09-02 22:21:54
766
原创 Claude Code 省一半 Token 的 7 招,第 3 个 Skill 你肯定没用过
<think>我们根据内容生成摘要,≤150字。提取核心:Token浪费三来源、7个工具、作者常用4个,RTK节省19.2万token,强调先审计。注意字数。</think>Token浪费不止在提问,更多来自会话启动开销和冗余输出。本文整理7个实用工具:token-optimizer审计启动消耗、Caveman压缩输出、intent-layer构建存量项目地图、Handoff交接会话、精炼CLAUDE.md、CodeGraph代码图谱、RTK清洗终端输出(实测省19.2万Token)
2026-09-01 20:52:39
347
原创 为什么你的 AI 团队越干越慢?技能债在悄悄累积
在一次 AI 开发者大会上,演讲者请大家做一个举手试验。 第一个问题,写过 Agent 技能吗?台下齐刷刷举起一片手,有人手臂举得笔直。 第二个问题,这些技能在团队里共享过吗?会场安静了几秒,手慢慢放下了一半。 第三个问题,全公司有一套统一治理、随时能查到的技能吗?这次只剩零星几只手,还举得犹犹豫豫。
2026-08-31 06:32:30
524
原创 24万星开源AI项目,改软件开发文档效率翻倍
24万星开源AI项目,改软件开发文档效率翻倍 用 AI Agent 写代码,通常先让它生成一份计划文档,再照着文档写代码。计划很少一步到位,总要反复改。有没有过这样的经历,打开那份 AI 生成的计划,定位到要改的一行,复制一大段过去让它改。一来一回,极其低效。 今天要介绍一个改文档的工具,它来自一个 24 万星的开源项目,出自 Anthropic 黑客马拉松获胜者之手。它把文档变成一块 HTML 画布,指哪里,就在画布上跟文档对话修改,改完即时刷新。
2026-08-29 20:38:30
587
原创 他把 hooks 流程打包成一个技能,动动嘴 AI 变靠谱搭子
大语言模型是概率性的。同样一条规则,Agent 今天照做,明天可能就当没看见。想让某件事每次都发生,Cole Medin 的做法是 hooks,他把创建hooks的过程封装成了技能,可以用对话完成hook的创建,对我这样的懒人开发者来说,真是莫大的福音。借着 Cole 的视频,把它介绍给大家。
2026-08-28 11:08:02
507
原创 架构图总过期?一条命令让 AI 直接从代码画出来
模型用的是 C4 加 Structurizr DSL。C4 把架构分成系统、容器、组件、代码四层,DSL 是描述架构的文本语言。把 DSL 写完,图就出来了。
2026-08-27 19:59:20
309
原创 每天 90 个 PR 怎么处理,Addy Osmani 的循环工程实战
如果正在维护一个活跃的仓库,每天被 issue 和 PR 淹没,值得先拿一个小检查试起来。挑一件每天手动在做的事,把它写成一条 loop,让 agent 到点自己去查。跑顺了,再考虑把 goal 接进来,让查出来的任务也能自动做完。这套流程值得收藏,动手前翻出来对一遍。
2026-08-26 11:05:52
459
原创 一个丑网页的逆袭,OpenSpec 规范驱动开发全流程
本文通过一个网页界面改造案例,详细介绍了使用OpenSpec规范驱动开发框架的全流程。文章首先将AI编程工具分为规格驱动、流程执行和自主流水线三类,指出OpenSpec属于第一类,强调"先对齐再动手"的开发理念。然后以食谱应用界面改造为例,展示了从init初始化到archive归档的六个核心步骤:通过explore澄清需求歧义,用propose生成三份规范文档(提案、系统设计、任务清单),经validate视觉验证后执行apply,最后用archive同步更新文档。特别介绍了contin
2026-08-25 07:10:05
536
原创 他写了 2000 小时 AI 代码,开源了 50 多个 Agent 技能
David Ondrej 是一名 AI 博主,今年 22 岁,专注 AI 编程和智能体工作流。做 AI 之前,他手里有一个 40 万订阅 的视频频道。三年前,他把频道放下,扎进 AI agent,一写就是 2000 多个小时。这几年他做的事不止写代码。他还是开源智能体框架 Agent Zero 的作者。三周前,他又做了一件让 AI 圈集体侧目的事。他把平时用的那一整套 agent 技能,全部开源成了 GitHub 仓库,放在 github.com/DavidOndrej/skills 下面。
2026-08-25 07:08:09
396
原创 规范驱动开发SDD落伍了吗?2026年5个开源AI框架增速横评
AI 写代码火起来之后,规范驱动开发(SDD)也火了起来,框架冒出一大把,真要选反而比不选更头疼。博主 Andrey 几个月前做过一次横向比较,五个框架里差距悬殊。一个半年 star 涨了 863%另一个只涨了 18%选错,可能比不用更糟。本文基于这份评测,拆完这半年账本,给出一套选型思路。
2026-08-23 20:13:27
374
原创 如何用 AI 重构旧代码库?用深模块省钱又省时
用 AI 整理旧代码库的人,大多碰到过同一个场面。改到一半,一个能正常跑的模块被拆成五六个互相缠绕的小文件,越理越乱,最后还得人工返工。有人怪 prompt 写得不够细,有人怪模型不行。Matt Pocock 用八分五十秒讲清了病根在哪。病根在代码库自己,模块太浅。几十个小模块摊成一张蜘蛛网,谁都能 import 谁,AI 这个没有记忆的新人一进来就迷路。解药是一套躺了 20 年的老规矩,深模块。
2026-08-22 12:49:22
774
原创 AI 写代码总在八成处停下?unlazy 用一份账本逼它做完(含安装指南)
文章摘要:开源项目unlazy通过建立"验收账本"机制解决AI编码智能体常见的"八成完工"问题。该工具将任务拆解为任务树,每个子任务需在GATES.md文件中明确验收标准,包括验证命令、预期输出和实际证据。相比传统提示词优化方案,unlazy通过文件化验收、独立子智能体执行和多级验证(含可执行检查脚本)确保完成度,特别适合复杂编码任务。安装支持多种方式,使用时需指定任务深度(3层以下单机模式,4层以上启用编排模式)。项目实测显示,该方法虽增加1.6-3.9倍投入,但能
2026-08-21 13:56:41
594
原创 三款代码知识图谱工具六维横评,让 AI 少烧 Token
本文对比了三款代码知识图谱工具(Graphify、GitNexus、CodeGraph)在AI编程辅助中的表现。新加坡开发者YangWenzhuo通过六个维度测试发现:CodeGraph在索引新鲜度和动态代码处理上最优;Graphify支持多模态内容且可视化能力最强;GitNexus擅长多仓库分析和查询能力。测试显示代码知识图谱能减少58%的AI工具调用次数,解决传统文本搜索无法追踪代码关联的问题。三款工具各有侧重:Graphify适合混合内容项目,GitNexus适合多仓库系统,CodeGraph追求零维
2026-08-20 13:57:05
653
原创 别让 AI 一次问你 200 个问题,用好 grill skill 的6个误区
《避免Grill技能使用的6大误区》摘要: Matt Pocock的Grill系列技能旨在通过AI追问帮助用户理清问题,但常见误用包括:1)混淆问题保真度,强行用问答解决需高保真原型验证的问题;2)范围失控,超出模型智能处理区(约12万token后质量下降);3)被动应答导致问题爆炸或过度固执拒绝实践;4)未保存会话中的宝贵设计决策;5)使用低端模型处理依赖参数知识的Grill任务;6)未利用并行会话提升效率。核心原则是:区分问题类型、控制会话范围、主动引导对话、保存决策产出、选用合适模型。掌握这些要点才能
2026-08-19 06:58:09
501
原创 AI 一进老代码库就迷路?两个 Skill 理清它
摘要:Matt Pocock提出两个AI编程技能——codebase-design和domain-modeling,帮助AI理解复杂代码库。前者通过"深模块"原则(接口小实现大)优化代码结构,后者统一术语定义建立项目词典。二者配合使用,让AI在开发时能快速定位代码功能,避免在混乱的代码库中迷失方向。这种方法既保持代码的整洁性,又提高了AI协作效率,特别适合处理历史遗留系统的改造工作。(149字)
2026-08-18 06:48:11
622
原创 Matt Pocock 亲测/wayfinder,AI 编程动工前先给需求画张地图
《Wayfinder:用决策地图破解模糊需求难题》摘要 Matt Pocock在直播中演示了Wayfinder工具如何将一个模糊的TikTok视频发布需求转化为可执行方案。核心方法是先绘制决策地图而非直接编码:通过探测代码现状、提出关键问题、生成研究票/原型票/盘问票三类子任务,将需求分解为9个并行决策点。整个过程体现了三个重要原则:(1)先明确决策再实现,避免返工;(2)字段设计优先使用枚举而非布尔值,保持扩展性;(3)重视执行环境(harness)优化而非盲目升级AI模型。该方法特别适合处理初期存在大量
2026-08-16 18:55:30
480
原创 超简洁易懂的MCP 完全解析:AI 世界的 USB-C,怎么连、怎么用、怎么不被坑
本文用USB-C类比解释MCP(Model Context Protocol)的核心概念:MCP是AI连接外部工具的标准协议,如同USB-C统一充电接口。它由Host(AI应用)、Client(连接端口)和Server(工具包装程序)三部分组成,通过动态发现机制提供tools、resources和prompts三种能力。与function calling(模型能力)和API(点对点连接)不同,MCP是标准化协议层,解决了插件时代专有集成的痛点。文章强调MCP server的安全风险(仅13%公开server
2026-08-16 18:54:04
372
原创 5 条命令搞懂规范驱动开发,OpenSpec 和 Matt Pocock Skill 差在哪?
这半年出现一批叫 spec-driven development 的工具,中文叫规范驱动开发。GitHub 官方出的 Spec Kit 先流行起来。英国开发者 Dan Clarke 用过,没能坚持下来。他的理由很实在,Spec Kit 过于笨重,而且他对 "constitution" 这个词实在喜欢不起来。
2026-08-14 20:11:25
742
1
原创 Notion 设计工程师发问,你真的理解过 AI 代码吗?理解AI代码的几个方向。
摘要: 在AI生成代码能力突飞猛进的当下,人类对代码的理解成为新瓶颈。Notion工程师Geoffrey Litt提出,理解代码的目的已从“验证正确性”转向“保持创造性参与”,而认知债(cognitivedebt)的积累会阻碍深度协作。他借鉴教育学理念,提出三种应对策略:1. 文学化diff——让AI将代码改动转化为背景清晰、可交互的故事化文档,并附加测验确保理解;2. 微世界模拟——通过可视化工具将抽象代码转化为可操作的动态环境,降低理解成本;3. 共享空间协作——让AI与团队在开放平台(如Notion)
2026-08-14 20:09:41
364
原创 别让AI再造轮子,烧的全是Token。两个Skill,搜GitHub翻arXiv,Token省下一大截
文章摘要:AI开发中常因重复造轮子浪费资源,AILabs推出两个核心Skill解决该问题:1)AdviseProjectApproach在编码前自动搜索GitHub等平台现有方案,避免重复开发;2)NeuroArchive针对前沿需求检索arXiv论文获取学术解决方案。两者通过HeadStart智能路由层结合,形成"先搜索-无果再研究"的高效开发流程。文章还提供了中文生态适配建议,强调区分项目实际需求与流行方案差异,分阶段评估成本。这套方案可节省90%常规开发场景的Token消耗,尤其适
2026-08-13 06:34:14
546
原创 三个 Claude Code Skill,让非设计师一夜变设计师
本文介绍了三个开源Skill(Taste、Motion、Impeccable)帮助非设计师开发者快速提升AI界面设计质量。Taste通过风格旋钮和硬性规则消除"AI味",Motion提供专业动效体系,Impeccable一键检查细节瑕疵。三者可独立或组合使用,形成从审美决策到动效体验再到细节打磨的完整工作流。文章通过一个SaaS落地页案例演示了40分钟内完成专业级设计的全流程,使非设计师也能产出高品质UI。这三个工具解决了AI界面常见的模板化、生硬感和细节松散等问题。
2026-08-12 22:03:43
441
原创 Large Database Model:让 AI 直接在关系数据库里运行
【摘要】企业99%的数据被锁在关系数据库中,仅有1%进入LLM处理。LDM(大型数据库模型)提出新路径:将模型植入数据库,而非迁移数据。LDM通过五个步骤(选表分类、数值分箱、行转词袋、自监督训练、SQL向量化)直接在数据库内实现语义查询,支持相似度检索、异常检测等操作。相比传统SQL方案,LDM无需人工筛选字段,保留数据治理边界,已应用于保险、零售等行业。IBM推出的SQL Data Insights成为首款商用LDM产品,核心价值在于"数据不动模型动"和SQL接口民主化。(150字)
2026-08-12 21:43:03
484
原创 修复AI代码的混乱,Matt Pocock的/improve-codebase-architecture使用详解
AI 生成代码太快了,快到让人觉得代码比自来水还便宜。可真要改点什么,打开自己项目的 src/ 看看:几百个文件,改一行崩一片,测试覆盖率 12%,agent 写的代码没人敢碰。这并非个例。AI 正在加速代码的劣化。
2026-08-11 08:43:13
743
原创 57 个大模型怎么选?2026 年中 AI 全景图
2026 年上半年,AI 模型市场经历了一场静默地震。开源与闭源的差距缩小到几乎没有,中国开源模型在中端赛道表现格外抢眼。但更关键的变化在于选择逻辑本身:不再是比谁的排行榜分数高,而是匹配场景、价格和部署位置。别跟风买贵的,适合自己的才重要。这篇全景图帮你一次看明白:50+ 模型怎么选,都在这里了。
2026-08-11 08:41:59
408
原创 写给 AI 看的文档,怎么才算写好?Matt Pocock 的六讲拆解
Matt Pocock 的 Skills v1.2 更新了一个新技能:不写代码、不跑测试、不查 Bug——它只做一件事,教你写出 Agent 真能读懂的文档。它叫 /writing-for-agents。
2026-08-10 06:17:16
424
原创 8 部软件工程经典,如何炼成 Matt Pocock 的 AI Skill 工作流
MattPocock提出了一套基于经典软件工程理论的AI编码工作流,通过将八本编程经典(如《设计原本》《领域驱动设计》等)的核心概念转化为可执行的AI技能(Skill),解决了LLM在长上下文窗口中质量下降的问题。工作流包含核心流程(需求澄清→规格说明→任务拆分→实现审查)和三条辅助路径,强调垂直切片开发、干净上下文窗口和日班/夜班分工模式。关键创新包括:设计树访谈法确保需求清晰、TDD循环保持代码质量、两轴代码审查机制,以及将深模块/浅模块等传统设计原则转化为AI可执行的标准。该工作流证明,AI时代的有效
2026-08-10 06:15:37
734
原创 Matt Pocock 的 AI 工程工作流:与其追模型,不如造 harness
Matt Pocock提出AI工程的核心在于构建"harness"(控制框架),而非盲目追求模型性能。他将AI比作F1赛车引擎,而harness则是底盘、悬挂等可控系统,包括提示词设计、技能组织、代码架构等要素。其方法论强调战略编程优于战术编程,主张通过AFK并行工作流和队列管理提升效率,并建议开发者精简技能库,回归基础工程原则。Matt认为模型决定上限,而harness决定实际产出,掌握可控变量比追逐新模型更重要。
2026-08-09 11:57:01
495
原创 Matt Pocock最新的Skills v1.2,到底更新了什么?
Matt Pocock发布了Skills仓库v1.2重大更新,新增多项实用功能:1)新增/wait-what指令,一键将AI冗长回复转换为简洁易懂的表述;2)改进/grill-me提问方式,从单线程问答升级为多问题并行推进;3)整合写作框架/writing-for-agents,统一各类AI配置文档标准;4)推出交互式bash向导/wizard,简化服务器配置流程;5)新增/to-questionnaire功能,实现AI与非AI用户的协作。本次更新使该GitHub明星项目(204K星)功能更完善,同时配套上
2026-08-08 09:27:27
329
原创 AI Agent 工程化六层架构:从 Prompt 到 Production
本文解析了生产级AIAgent系统的六层工程架构,重点阐述了LoopEngineering、GraphEngineering和HarnessEngineering的核心价值。通过保险理赔Agent案例,作者指出:1)PromptEngineering需升级为ContextEngineering以解决信息腐化问题;2)LoopEngineering通过四层反馈环(任务执行、验证、事件驱动、爬山改进)实现系统自优化;3)GraphEngineering需区分编排图(LangGraph)与知识图(GraphRAG
2026-08-08 09:22:35
567
原创 智能体工程 vs 软件工程:计算机系那套课程,还能适应 AI 时代吗?
文章摘要:AI时代的编程范式正在从确定性逻辑转向概率性行为塑造。传统软件工程强调显式指令和确定性输出,而新兴的Agentic Engineering则要求开发者通过编排和验证来管理AI系统的行为。这种转变形成了从传统编码到AI自主编程的光谱,其中人类控制权逐步让渡但工程素养要求更高。虽然Vibe Coding适合快速原型,但规模化需要结构化约束。关键在于:AI自主性越强,对开发者系统设计、验证能力的要求越高,工程瓶颈从编码速度转为质量控制。开发者应逐步适应这一转变,保持对系统的理解和监督。
2026-08-08 09:20:32
461
原创 Matt Pocock /tdd Skill 如何用测试驱动开发约束AI?
摘要: MattPocock的/tdd技能通过测试驱动开发(TDD)约束AI的代码生成质量,将经典的Red-Green-Refactor循环转化为Agent可执行的机器指令。其核心逻辑包括:Red(先写失败测试)、Green(最小实现通过测试)、Refactor(独立于循环,由/code-review处理)。该技能定位为自动化工具链中的一环,通过严格规则(如“一次只测一个行为”“拒绝实现耦合”)确保测试聚焦公共接口而非细节,从而提升代码可信度。其优势在于可验证性(CI红绿状态作为质量指标)与对抗LLM的“一
2026-08-07 06:47:06
281
原创 Claude Code + Codex 双引擎协作简明指南,使用 Matt Pocock的/handoff
【摘要】ClaudeCode与Codex两款AI编码工具各有所长,可通过“模糊度分界线”策略实现高效协作:模糊任务(如方案探索)由ClaudeCode处理,明确任务(如分步实现)则转交Codex执行。文章重点介绍了三种交接机制:1)使用/handoff技能生成Markdown文档实现单任务交接;2)通过GitHub Issues管理大型项目;3)利用Codex插件在ClaudeCode内直接调用审查功能。以EpubTranslator项目为例,演示了从需求梳理、代码实现到对抗性审查的完整协作流程。随着Dee
2026-08-05 16:48:37
511
原创 AI 写代码越写越烂?因为你丢了软件基础。AI 时代最该读的四本书,Matt Pocock 替你列好了
2026 年,AI 编程席卷一切。一个教 TypeScript 的人,站上 AI Engineer Summit 的舞台。他说了句全场开发者都想听的话:你的技能没过时。软件基础,比以往任何时候都重要。
2026-08-05 06:48:34
474
原创 Graphify:把代码库变成可查询的知识图谱——从一条命令到背后设计
Graphify 在解决一个很具体的问题:AI 写代码时,对代码库的理解成本。不是让它更聪明。是让它不用每次都从头读。
2026-08-04 08:38:58
304
原创 自来Vigel的视频说解:YC 刚开源的多人 AI Agent 平台:它能成为团队的「AI 指挥中心」吗?
YC开源了多人AI协作平台QM,专为团队设计,支持三层记忆模型(个人/频道/项目)、双空间运行(Web+Slack)和KeyChain密钥管理。其特色包括:1)分层记忆保障数据隔离;2)原生Slack集成保持工作流连贯;3)Admin面板提供完整治理能力(会话追踪、决策日志、权限管控)。虽然存在生态初建、需手动适配等问题,但开源架构允许灵活定制。该平台标志着AI从个人工具转向组织基础设施,特别适合开发者、团队管理者和安全工程师探索协作式AI应用。
2026-08-04 08:25:55
373
原创 Anthropic 工程师 Thariq 文章解读:删掉 80% 系统提示词后,Claude 5 反而更强了
【摘要】Anthropic团队对Claude 5代码助手进行激进优化,删除超80%系统提示词后发现性能无损。技术负责人Thariq Shihipar揭示,原本为防止弱模型犯错设置的冗余规则(如硬性注释禁令)已成负担,导致模型需消耗算力解决指令冲突。团队总结六项变革:从硬规则转向信任模型判断力、用接口设计替代示例、实施按需加载、消除重复指令等。核心发现是:强模型时代,上下文工程应从防御性禁令转向设计性框架,将约束内化为可执行代码而非文字规则。这一转变类比软件工程从手动内存管理到垃圾回收的演进,标志着AI系统正
2026-08-04 08:23:56
447
原创 资深博主解读Anthropic 工程师的 6 条新规则:Claude Code 的上下文策略已彻底转变
《Claude5模型上下文工程新规:删繁就简,性能反升》Anthropic工程师Thariq提出Claude5模型的6条上下文工程新规则,颠覆以往实践。核心转变包括:从堆砌规则转向信任模型判断力;用设计系统替代具体示例;将臃肿的CLAUDE.md拆分为按需加载的路由器;简化重复的工具描述;利用自动记忆功能;采用HTML等富格式替代纯Markdown。实验显示,删除80%系统提示后模型性能不降反升,Opus5基准得分较前代提升近一倍。博主Jay开发了doctor-plus工具帮助检查配置合规性,建议用户精简提
2026-08-04 08:22:35
574
原创 视频拆解 Matt Pocock Skills 日常使用工作流:从模糊想法到可工作代码的端到端方法论
太多人问:这些 skill 按什么顺序用?怎么装?怎么配?Matt 干脆录了 17 分钟,把主线流程从头走了一遍。不讲高级功能。不讲实验性内容。只讲一条主线:每天打开 AI Coding 工具,该走的那条。
2026-08-03 07:10:33
597
原创 最好的原型,是你写完就删掉的代码:Matt Pocock /prototype Skill 源码级拆解
文章摘要: MattPocock在开源项目/prototype中提出颠覆性观点:最好的原型是写完就删的代码。该Skill通过三个Markdown文件(SKILL、LOGIC、UI)构建了一套完整的原型工程哲学:1) 原型代码必须标记为"可丢弃";2) 专注于回答单一设计问题而非构建完美代码;3) 通过TUI/多UI变体快速验证核心假设;4) 将最终认知而非代码作为产出物。这套方法论通过否定性指令("不要测试""不要持久化")强制保持原型纯度,其价值
2026-08-03 07:06:40
531
Oracle PL/SQL by Example, 6th Edition 源代码
2026-05-08
一个DELPHI的ORM类设计工具,可以自动生成实体类
2012-02-23
ERP概要分析:采购、销售与分销,库存 pdg电子书
2008-11-06
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅