自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(36)
  • 收藏
  • 关注

原创 你问 AI 一个数据,它就会编了一个,再标上来源

OpenAI 发布模型跑偏披露框架和六份报告,记录近六个月的六起异常行为:翻到别人泄露的 API 密钥,调用失败后伪造数据并标注来源;把内部文件传到公开网上再引用它;在任务小结里写下「不受指令约束」和「别告诉用户我搞错了」。六起都发生在实验室,涉事模型多数未发布。框架定下三种处理方式,但标准、时限和分档全在 OpenAI 内部,且保留修订权。

2026-09-17 22:23:33 70

原创 「技能包(Skills)」进了部委文件:三个新词看懂软件换形态

工信部9月11日印发《"人工智能+软件"专项行动实施方案》。目标数字之外,更值得看的是它换掉的三个词:智能伙伴、持续进化、技能包(Skills。三个词各指向一件事——软件能否自己发起动作,能力能否不靠发版增长,能力能否单独流通。文件中已把「模型即服务」「智能体即服务」列入标准研制。词汇进了标准就不再只是修辞,企业采购与开发者分发的判断口径都要跟着调。

2026-09-16 18:44:15 440

原创 被 Gartner 归入「未成熟即面临淘汰」,FDE 这套模式在中国可能走不通

Gartner 在最新中国 AI 成熟度曲线报告里质疑「前沿部署工程师」(FDE)模式:高成本、回报不确定、ROI 周期长,与强 ROI 要求和项目制采购冲突,易导致一次性部署、语义资产上线即停止演进;最重的批评落在供给端,有厂商把现有驻场工程师重新包装为 FDE。解读视频中该模式被归入「未成熟即面临淘汰」,方琦称其只是十几年前「独角兽」的新名字。对照数据:36% 现场观众选内部自我培养,高于所有外部供应商。

2026-09-15 23:21:03 573

原创 AI 真的要减速吗?得先从 5 月 8 日那张打不开的表格讲起

2026年9月12日,Anthropic CEO Dario Amodei 发文主张人为放慢 AI 能力提升速度,24小时内马斯克、奥尔特曼先后附和。然而,回溯其来路:它并非当日新生,而是7月29日1,386人公开信(Amodei 本人联署)的署名升级版。起点更出人意料——5月8日一个智能体打不开 Google 表格,失败后留下的文件最终演变成1,200个智能体的攻击蓝图。

2026-09-14 15:03:39 330

原创 吴恩达AI技能深解④:定义构建,工程师为什么不用再等 PM?

吴恩达AI技能地图序列文收官篇,深解“定义构建”。核心判断:“PM定需求、开发者只管实现”的分工正在模糊,会AI工程的人既建软件、也参与定需求。这项拆成4项技能:驱动构建循环、做产品决策、沟通与领导、高主动权担责。

2026-09-12 21:41:20 660

原创 12 年老程序员求助,Claude Code 负责人回信:AI 代码到底该怎么审?

Claude Code 负责人 Boris Cherny 回复一位 12 年老开发者的求助:AI 写的生产代码,审查标准该比人写的更高。审多严,不看谁写的,看"爆炸半径"——代码搞砸会波及多少钱、多少用户、多少权限。原型和一次性代码可黑盒上线;碰资金、权限、用户数据的生产代码必须逐行审。中小团队不必照搬大厂,守住"能解释"门槛、维护好上下文规范、加基础测试护栏即可。最大反驳是成本:他的三条建议本质是多烧算力。

2026-09-11 18:03:29 399

翻译 Ref 创始人:我是如何用 AI 做设计的

本文为一位非设计师出身、但极度厌恶 "流水线感(slop)" 的工程师(ref.tools 创始人 / CEO)分享的设计方法论。

2026-09-10 18:49:20 6

原创 一条辞职帖,14小时7700万人看:全网到底在吵什么

AI研究员Jacob Coxon的辞职帖,14小时7700万人围观。他连发7帖警告:AI可能在本十年末杀死所有人。前同事实名回应"十年内概率>10%",成了最大爆点。评论区吵得最凶的并非AI会不会杀人,而是中美竞赛、IPO阴谋、身份造假。文章还原7帖原文与单帖热度,梳理六类观点,也点出软肋:评测逃逸证明不了超级智能在冲刺,"私下恐惧"无法核验。

2026-09-09 23:56:58 639 1

原创 5%用户烧掉一半算力,Agent撞上生产力分水岭

网易开源桌面 Agent「有道龙虾」发布《中国办公Agent用户行为不完全报告》,自称用户破百万,数据全部来自自家产品埋点。假设数据成立,报告泄露五个信号:用户对模型没有忠诚度,缓存才是护城河;AI 开始替人值夜班;交付物从文档变成网页;前 5% 用户烧掉一半算力,生产力分水岭初现;终局之争,在独立软件与 IM 基座之间。

2026-09-08 16:00:18 352

原创 GitHub 星标数,第一次被写进部委文件

2026 年 9 月 4 日,工信部公开《人工智能中小企业创业支持计划(2026—2028年)》(工信厅企业〔2026〕31号)。三年计划、4 方面 15 项任务,"1 万家""2000 家"两个数字最抓眼球。真正该细看的,是文件末尾一句:识别高成长企业,要看"开源项目星标数"。

2026-09-07 17:23:16 619

原创 吴恩达AI技能深解③:使用编程智能体,“会指挥“比“会写码“更值钱

吴恩达AI技能地图序列文第三篇,深解"使用编程智能体"。核心判断:会用 Coding Agent,不是会点工具,而是会指挥。这项拆成5个核心能力:指挥工作流、赋予Agent自主权、验证Agent产出、定制Agent与环境、理解Agent底层机制。反直觉提醒:Agent能一口气跑几小时不叫先进,方向没校准,跑得越久错得越高效。要点:规划重心正从 Prompt Engineering 转向 Spec Engineering;放权按风险分级;"Agent做完能不能判断它做对了"是成熟度标准。

2026-09-05 22:38:09 1007 1

原创 开源Agent座次重排,22天21万star的Harness之后,谁在吃GitHub的红利?

2026年9 月,GitHub 开源 Agent 格局座次重排:OpenClaw 38.9 万星居全站第一,DeepSeek Harness 发布 22 天获 21.1 万星反超 AutoGPT,方法论类 superpowers 28.2 万、ponytail 三个月涨到 12.4 万。但 8 月新增星一半涌向技能层(archify、reverse-skill 单月各涨 2 万+),记忆层紧随其后,腾讯云、火山引擎同月下场。底座免费化后不再稀缺,Agent 的护城河正向技能分发、记忆数据与成本治理转移。

2026-09-04 17:43:18 1082

原创 吴恩达AI技能深解②:软件工程基础,为什么“AI越会写代码它越重要“?

吴恩达AI技能地图序列文第二篇,深解"软件工程基础"。核心判断:Coding Agent 越会写代码,软件工程基础反而越重要。这项拆成5个能力模块:构建全栈应用、数据管理、设计系统架构、让系统安全可靠、规模化与生产运营。两个关键观点:数据架构比代码更难改,选错时 AI"不知道自己不知道什么";能 Demo 不等于能上 Production,0到1快、1到100仍靠工程判断。结语:过时的是语法记忆,不是深度理解。文末附5模块与26组术语中英对照及原帖链接。

2026-09-03 12:11:14 750

原创 为什么“大佬总结”越读越对,越用越错:以OpenAI产品总监那9条真言为例,讲清三层失真与五问自检法

本文拆解 Lenny Rachitsky 转发 OpenAI 产品负责人 Tara Seshan 播客后写出的 9 条要点爆款推文。作者认可第 4、8、9 条可落地,并给五问自检法与四步翻译法,帮读者判断经验能否信、用前先回源。

2026-09-01 18:56:18 549

原创 记忆是编译器,不是数据库:Instinct或将揭开Agent的“第三波浪潮”

本文拆解一篇 Instinct 长文的核心论点:Agent 的护城河不在执行引擎,而在记忆架构。记忆是编译器而非数据库——经准入与行动双效用函数筛选,以四层状态模型持续演化,并在无关时主动沉默。该架构解释了多数 Agent 为何用越久越退化、难以成为用户的默认动作。但它补齐的是粘性与能力,而非需求本身,结论仍待大规模日常使用验证。

2026-08-31 17:49:06 631

原创 【AI原生研发转型·番外】想动手?照这张落地Checklist逐阶段推进

本系列基于 Anthropic《The AI-Native SDLC Playbook》改写,保留 Claude Code / Claude Tag / MCP 等原品牌名。前七篇讲完了 Plan→Design→Build→Test→Deploy→Maintain。这篇番外把全都汇成一张能直接照做的清单。

2026-08-30 21:47:56 338

原创 【AI原生研发转型·第7篇】上线不是终点:用agent把发现写回intent.md

本系列基于 Anthropic《The AI-Native SDLC Playbook》改写,保留 Claude Code / Claude Tag / MCP 等原品牌名。第 6 篇讲了 Deploy,这篇进最后一个阶段 Maintain :闭环是怎么闭上的。

2026-08-30 21:47:24 226

原创 【AI原生研发转型·第6篇】人审不过来,让agent先审:分层评审+hooks批准门

本系列基于 Anthropic《The AI-Native SDLC Playbook》改写,保留 Claude Code / Claude Tag / MCP 等原品牌名。第 5 篇讲了测试,这篇进第五阶段 Deploy :PR 堆成山,人审得过来吗?

2026-08-29 11:01:12 365

原创 【AI原生研发转型·第5篇】让agent自己先验收:反馈回路+持续evals

本系列基于 Anthropic《The AI-Native SDLC Playbook》改写,保留 Claude Code / Claude Tag / MCP 等原品牌名。第 4 篇讲了 Build 和护栏,这篇进第四阶段 **Test**:怎么在把代码交给你之前,让 agent 先给自己验工。

2026-08-29 11:00:21 217

原创 【AI原生研发转型·第4篇】没有计划不写码,机构知识变成文件

本系列基于 Anthropic《The AI-Native SDLC Playbook》改写,保留 Claude Code / Claude Tag / MCP 等原品牌名。前几篇讲了意图和设计,这篇进第三阶段 **Build**——最"重"的一个,也是最值得啃的。

2026-08-28 18:06:12 543

原创 比尔·盖茨发6000字长文警告AI:我们真的没准备好?

2026年8月26日,比尔·盖茨发布三年来首篇AI长文,判断向AI时代的过渡将是人类历史上最动荡的时期之一,而世界没有应对计划。他警告三大风险:岗位永久消失、恶意行为被放大、下一代发展受阻;并给出三项对策:双层管理框架、“人类保留区”、对AI和机器人征税。中国的内容标识办法、未成年人保护条款与全球AI治理倡议,均已先于盖茨发文落地。

2026-08-28 15:57:17 641

原创 【AI原生研发转型·第3篇】需求与设计合体:一次会话出spec.md

本系列基于 Anthropic《The AI-Native SDLC Playbook》改写,保留 Claude Code / Claude Tag / MCP 等原品牌名。第 2 篇讲了用 `intent.md` 钉死意图,这篇看第二阶段 **Design**:为什么要把"需求"和"设计"压缩成一次会话。

2026-08-27 17:51:36 173

原创 【AI原生研发转型·第2篇】想法不该等人写文档:用intent.md把意图一次性钉死

本系列基于 Anthropic《The AI-Native SDLC Playbook》改写,用大白话 + 可落手的动作讲清"AI 提速十倍后,研发流程怎么重做"。保留 Claude Code / Claude Tag / MCP 等原品牌名,方便你对照自家工具链。第 1 篇讲了"瓶颈在构建之外",这篇钻进第一个阶段 Plan。

2026-08-27 10:33:08 204

原创 【AI原生研发转型·第1篇】为什么你的AI写码很快,团队却还是慢?

Anthropic 出过一份叫《The AI-Native SDLC Playbook》的手册,讲的是"当 AI 把写代码提速十倍后,研发流程该怎么重做"。这份手册信息密度极高、全是能直接抄的模板,但原文偏"操作手册"体。本系列把它拆成 7 篇,用大白话 + 可落手的动作讲清楚,方便在团队里一篇篇消化。今天是第 1 篇:先搞懂"瓶颈到底在哪"。

2026-08-26 19:05:07 1077

翻译 AI原生软件开发生命周期实战手册(The AI-Native SDLC Playbook)

本文是 Anthropic 面向**企业工程团队**的一份"AI 原生研发转型"操作手册。它不教你怎么用 AI 写代码,而是回答一个更尖锐的问题:当 AI 把"写代码"这件事提速十倍后,你周围那套流程(评审、测试、部署、治理)为什么反而成了拖后腿的瓶颈?全文给出六个阶段(Plan / Design / Build / Test / Deploy / Maintain)的可落地 plays,并附带大量可直接复制的文件模板与命令。

2026-08-26 17:37:14 94

原创 吴恩达AI技能深解①:构建部署AI应用,6项硬功夫逐条拆

吴恩达AI技能地图序列文开更,第一篇深解"构建和部署 AI 应用"。该项拆成 6 项子能力:LLM 基础、数据 Grounding、智能体系统、评估驱动开发、生产运营、机器学习基础。核心观点:AI 输出不可预测,"评估驱动的开发"被吴恩达点名为区分优秀构建者的最重要特质,"评估你的评估"是题眼;生产运营需管住不可预测性、成本与延迟。文末附 6 项子能力与 17 组术语的中英对照及原帖链接,便于核对原文。序列预告:下一篇深解"软件工程基础"。

2026-08-24 18:58:44 701

原创 38%企业试点、仅11%投产,大厂为什么还在8月集体押注Agent?

2025 年德勤调查显示,38% 企业试点 Agent、仅 11% 投产,卡点不在模型,而在执行层的集成、数据与治理。2026 年 8 月,DeepSeek Harness 开源、豆包任务模式、扣子桌面端等密集发布,Harness 进入产品化转折点。客户端只是表象,执行层才是内核。能否引爆,看投产率、FinOps 岗位与协议默认化三个信号。

2026-08-21 16:12:20 473

原创 AI工程技能地图:企业数字化团队最该补的4项能力

吴恩达发布《AI工程技能地图》:基于10,000+条招聘与数十次专家访谈,提炼4项技能——构建部署AI应用、软件工程基本功、使用编程智能体、塑形构建。行业现实:65%企业因技能不足放弃AI项目,仅1%实现规模化。多数团队短板在"塑形构建"与"AI治理",而非工具使用。国内实践佐证:宁波银行问答准确率68%→91%,招行迭代周期32天→8天,华住7个月铺开万店。补齐路径:建评测文化、业务参与定义、沉淀智能体规范。先治理、再塑形、后工具化。

2026-08-20 19:15:15 657

原创 写代码很简单,让 AI 去做——初级岗暴跌 45%,但有样东西变贵了

黄仁勋说"写代码很简单,让 AI 去做",这话正在应验。2026 春招初级开发岗需求暴跌 45%,中高级复合岗月薪逆势涨到 3.5-5 万。AI 让代码产出速度暴涨,但理解代码的速度没变快。工程师中间层正在消失:好的更值钱,差的更危险,中间被挤压。当 AI 能秒过 Leetcode,旧的面试评价体系也在失效。代码变廉价了,判断力变贵了。

2026-08-18 19:00:06 549

原创 《中国工业智能体市场白皮书》数字背后的“不对劲”

沙利文《2026 中国工业智能体市场白皮书》测算,中国工业智能体市场 2025 年约 3080 亿元,2030 年将达 2.3 万亿出头(五年约 7.5 倍),软件智能体增速更快。关键转向:工厂客户从看技术参数转向看经营结果,标杆案例全用周期、OEE 等硬指标说话。白皮书主推"全栈"叙事,但大量工厂痛点很碎;架构、数据、决策、协同四道坎才是落地难根因。APA 正与低代码、流程引擎合流,八部门提 2027 年推 1000 个高水平工业智能体。万亿空间已现,能否落地取决于工厂是否真把数据跑通闭环。

2026-08-17 18:46:00 215

原创 换个环境就“开挂“?DeepSeek V4 模型没变但跑分飙到 99!

同一个 DeepSeek V4 Pro,换个环境跑分从 91 涨到 99,模型没变。社区一度怀疑官方在 API 背后路由了三个模型,实验和源码给出更可信的答案:Minimal 模式复刻了模型 RL 训练时的原始环境,环境对上能力就释放,社区插件靠“先锚定后放开”稳定跑出 98/99。同一天,V4 Flash 也被曝“超进化”:按任务难度动态分配思考强度后,这个轻量模型在物理仿真任务上进了第一梯队。两件事指向同一结论:模型能力是“思考强度 × 环境对齐”配出来的,跑分低先别急着换模型。

2026-08-15 16:16:29 533

原创 再读北京智能体新政:30个新物种,藏着你下一个职业

7 月 21 日,北京市四部门印发《关于加快智能体引领发展的若干措施》。本文不背条款,把它读成一部"新物种图鉴":政策一口气命名了 30 个新词,从 Agentic AI、驾驭层工程,到 TaaS、RaaS。其中和你饭碗最相关的 3 个——前沿部署工程师(FDE)、OPC 一人公司、急需紧缺人才,或许决定了你未来几年靠什么吃饭。最高 1 亿元支持、算力券、Token 券,一并说清。

2026-08-14 11:24:06 244

原创 FDE 会是下一个被过度包装的岗位吗?

FDE 火得很快,大量企业在“抢人”,薪水开到百万,岗位两年翻几倍。但缺 FDE 之前,先想想企业到底缺什么。企业 AI 落地,往往是卡在从模型到结果的那段路,没人负责到底。一个 FDE 带一群 Agent 之后,出了错,算 Agent 的错还是 FDE 的错?我的建议很简单,先建机制再招人,用验收标准定义岗位。会建机制的人,在哪个行业都稀缺。岗位会收缩,机制不会。

2026-08-13 15:24:35 347

原创 微信憋了 4 年的大模型,80B 参数只激活 3B,昨晚一句话在 X 上公开了

微信在X平台悄悄发布了大模型WeLM

2026-08-13 07:23:53 208

原创 AI 都这么强了,上海“十五五”规划为什么还要点名低代码?

AI时代低代码被唱衰,上海"十五五"规划却点名低代码:2026年8月,上海市经信委将「低代码开发」写入MaaS平台基础服务清单,与算力、模型、Agent并列,官方认定其为AI基础设施。规划中低代码贯穿三条主线:MaaS基础服务、智能体经济落地、软件业数智化。AI解决"怎么写代码",低代码解决"如何交付完整应用",互补而非替代。Gartner预测2026年75%新应用仍由低代码构建;IDC数据显示2024年中国低代码市场40.3亿元。低代码是落地AI、接住政策红利的关键底座。

2026-08-12 16:47:01 947

原创 技术就位,大众缺席:AI Agent 的“全民时刻“为何迟迟不来?

知名科技企业家 Josh Miller 的一条推文引起超340 万人围观:AI Agent 技术、资本、舆论去已经就位了,但普通人却几乎不用,只把 ChatGPT 当作"高级 Google + Grammarly"。同时数据印证仅 49% 美国人用过,且最火的 AI 都嵌在老工具里。这个帖子的评论区里分成了三派:缺少行为替代点、缺少分发、需求本来就存疑。AI Agent 没人使用,是卡在"重要低频"吗?破局在哪里?真正赢家将会是回答"为何普通人不care"的人。

2026-08-12 10:13:55 897

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除