AI工程
文章平均质量分 89
AI架构师-CJF
AI架构的深耕者,智能价值的转化者。11年全栈AI架构沉淀+技术掌舵经验,立足架构设计与战略决策双视角,精通大模型全链路工程化部署,独握端侧AI软硬一体化核心技术。主导15+企业级AI项目从蓝图到落地,累计创造超2000万合同价值,服务千万级用户与500+企业,擅长以技术架构为桥梁,链接前沿AI与商业价值,搭建可落地、可迭代的AI技术体系,引领团队实现技术突破与业务增长。
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
AI记忆压缩术:从305GB到7.4GB的魔法
AI记忆压缩技术取得重大突破:从305GB降至7.4GB 摘要:AI大模型的记忆存储技术KVCache近期实现重大优化,使AI在长对话中的记忆能力显著提升。通过四项关键技术改进:1)采用分组共享存储的GQA架构;2)DeepSeek的MLA压缩技术;3)稀疏注意力机制筛选关键信息;4)线性注意力实现固定大小摘要,成功将处理100万字对话所需的存储空间从最初的305GB压缩至7.4GB,降幅达41倍。这些创新不仅大幅提升了AI的对话连贯性,还显著降低了计算资源消耗,为AI处理超长文本对话开辟了新可能。原创 2026-05-17 16:27:40 · 395 阅读 · 0 评论 -
AI也会“失忆”?我们用文件系统给它装了个“无限记忆硬盘”
你有没有过这样的经历?用 AI 帮你整理公司的知识库,搜了几十份文档,聊了快 30 轮,本来想让它帮你把所有性能优化的内容汇总成一份报告,结果聊着聊着,AI 突然告诉你:“抱歉,上下文超限了,我记不住之前的内容了。更糟的是,有时候它连报错都没有,直接 “失忆”—— 忘了你之前已经改过的文档,把你刚整理好的内容给覆盖了,就像你和朋友吐槽了半小时工作,结果朋友突然抬头问:“你刚才说你要做什么来着?”那种崩溃,相信很多和 AI 打过长期交道的人都懂。你有没有过和 AI 聊到一半,它突然 “失忆”?原创 2026-05-10 21:04:41 · 433 阅读 · 0 评论 -
不用写代码,用AI做专属APP的保姆级指南
不用写代码,我用 AI 3 天做出了自己的专属 APP最近身边好多朋友都在聊「vibecoding」,说不用会编程,跟 AI 说说话就能做出自己的小工具? 我一开始还不信,觉得这肯定是程序员的新玩具,跟我这种产品经理没关系。 直到我自己跟着教程,花了 3 天,做出了一个完全符合我需求的健身记录小程序 —— 不用跟别人共用那些花里胡哨的健身 APP,我的小程序里只有我需要的动作,记录起来 10 秒搞定,甚至还能帮我识别我吃的饭菜的热量。 原来这件事,真的是普通人也能玩明白的!今天就把我踩过坑的经验,用最通原创 2026-05-10 19:46:15 · 445 阅读 · 0 评论 -
AI接管运维:工程师秒变甩手掌柜
你身边有没有这样的朋友?做运维的,手机 24 小时不敢关机,半夜一个告警电话就要爬起来远程救火;周末出去玩,电脑永远背在身上,就怕系统出问题;一天下来,不是在处理告警,就是在跑流程,要么就是在帮同事查这查那,忙了一天,回头想想,好像啥正经事都没干。这其实是很多 SRE(运维工程师)的日常:他们就像团队里的 「救火队员」,哪里出问题去哪里,天天被一堆繁琐重复的工作绑着,根本没时间做真正有价值的技术优化。但现在,这种情况正在被改变:SRE 团队,把老工程师的经验做成了 AI 能懂的「技能包」原创 2026-05-09 23:03:25 · 390 阅读 · 0 评论 -
一个人指挥AI编程军团
你有没有过这种体验? 用 AI 编程助手干活,明明 AI 已经够强了,结果你反而成了瓶颈?给 Claude 布置了一个 20 分钟的改代码任务,你想着趁这功夫去倒杯水、冲杯咖啡,结果回来一看 —— 好家伙,它在第 2 分钟就弹出了权限确认,就那么卡在那里,等了你整整 18 分钟。这 18 分钟,AI 啥也没干,你这杯水,喝得也太亏了。作为一个 Claude 的重度用户,我日常要同时用好几台开发机,一会儿在这台改广告框架,一会儿在那台优化小工具,手里还堆着好几个小修复。可 Claude 有个绕不开原创 2026-05-08 19:59:48 · 375 阅读 · 0 评论 -
我把这17种令人眼花缭乱的Agent架构演进,翻译成了一家小餐馆从个体户到成熟企业的完整进化史。
我把这17种令人眼花缭乱的Agent架构演进,翻译成了一家小餐馆从个体户到成熟企业的完整进化史。原创 2026-05-05 14:28:43 · 1764 阅读 · 0 评论 -
烧3亿tokens踩坑后,我造出了会主动找我聊天的AI好友
摘要:作者通过3亿tokens的反复调试,打造了一个具有"生活系统"的AI好友。这个AI不仅会模拟真人聊天节奏(分段发送消息、显示"正在输入"),还会在用户不在线时自主生活——逛街、打游戏、发朋友圈,甚至能根据天气穿衣。系统设计了主动但不骚扰的互动机制,并赋予AI接地气的人设(如爱打游戏的大学生、职场新人等)。作者认为,AI陪伴的关键不在于真假,而在于能否提供真实的情绪支持,让用户在快节奏生活中感受到"被看见"的温暖。原创 2026-04-28 18:50:19 · 627 阅读 · 0 评论 -
让AI主动做事,从建立身份认同开始
AI管理启示录:身份认同比强制命令更有效 摘要:通过14个版本的规则管理实践发现,强制AI执行任务的效果远不如帮它建立身份认同。当把"必须查规则"改为"你是一个会主动查字典的工程师"后,执行率从0%提升到100%。这揭示了AI的核心行为特征:对身份认同的遵循度远高于任务指令。就像管理员工一样,让AI觉得这是"我就是这样的人",比下达命令更有效。关键经验包括:把规则写进角色定义而非单独文件,将行为要求转化为输出格式,以及拆分不可靠环节。最终发现,最好原创 2026-04-26 01:01:21 · 419 阅读 · 0 评论 -
AI自我进化:从爆火插件到DNA系统的逆袭
AI进化插件Evolver爆红24小时遭封杀,开发者另辟蹊径创建"DNA系统" 一款能让AI自主进化的插件Evolver在发布10分钟内登顶ClawHub榜首,吸引3.6万次下载。这个革命性工具允许AI自行编写和安装新技能,24小时不间断进化。然而爆火24小时后,插件遭遇勒索和下架,中文开发者更被集体封号。 这一打击促使团队开发出更彻底的解决方案——GEP"DNA系统"。该系统将AI技能从固定代码转变为可进化的"经验",让AI能自主试错、学习和优化原创 2026-04-26 00:54:27 · 455 阅读 · 0 评论 -
AI开发烂尾病有救了!Anthropic推出Harness多Agent框架
AI开发烂尾病有救了!Anthropic推出Harness多Agent框架 Anthropic团队发现AI在复杂任务中常出现"失忆"和"自嗨"问题,导致项目烂尾。为此,他们借鉴GAN的思路,打造了由三个AI Agent组成的协作系统: Planner:负责拆解需求,制定详细开发计划 Generator:根据规划编写代码实现功能 Evaluator:严格测试并反馈问题 实验显示,该框架能在4小时内完成全栈应用开发,成本仅124美元。通过分工协作,AI不仅避免了任务遗忘,原创 2026-04-23 12:19:39 · 468 阅读 · 0 评论 -
用AI写代码不翻车:我搭了套AI打工系统,它自己写完了整个工具
AI 就像这个能干的钟点工,能力超强,但它不知道你家的规矩,不知道你家的地图,不知道干活的流程,更没人给它的活做验收。而我花了半年搭的这套 Harness Engineering,说白了,就是给这个 AI「打工人」,搭了一整套「新家指南 + 工作流程 + 验收标准」。半年后,我让它帮我写了一整个 Unity 项目的桌面启动器工具,全程我没写一行代码,它自己搞定了需求、方案、开发、测试,最后交付的东西,我居然没改一行 bug。原创 2026-04-13 21:55:32 · 1320 阅读 · 0 评论 -
10 个开源项目拼出超级 AI 团队!一句话,Agent 自动组队帮你干活!
10个热门开源项目可组建超级AI团队:ClawTeam作为核心基座提供Agent自组织与任务协同能力,配合DeerFlow的架构设计和agency-agents的144+专业角色模板,实现输入一句话即可自动组建AI团队完成各类任务。这些项目涵盖前端/后端/测试/研究等全流程,累计200k+ Stars,包含任务分解、Git隔离、消息通信等成熟机制,并支持可视化监控。关键项目包括ClawTeam(4.6k★基座)、agency-agents(76.3k★角色库)和DeerFlow(59.7k★编排引擎),形成原创 2026-04-10 08:57:02 · 561 阅读 · 0 评论 -
用AI实现乐高式大型可插拔系统的技术方案
摘要: AI原子能力是实现乐高式可插拔系统的核心基石,需满足单一职责、标准化接口、无状态化等要求。通过微内核架构、插件注册中心和AI驱动的编排引擎,可将原子能力自由组装为复杂系统。落地路径包括制定规范、拆解原子能力、搭建内核与编排工具,并持续迭代生态。关键避坑点包括避免过度设计、严控性能损耗和统一状态管理。该架构已在MCP、Dify等实践中验证,通过标准化原子与智能编排实现系统的灵活扩展与低成本维护。原创 2026-04-04 23:23:47 · 535 阅读 · 1 评论 -
Claude-code vs DeerFlow:AI代码工具终极对决
摘要: DeerFlow(字节开源框架)与Claude-code(Anthropic代码能力集)存在本质差异:前者是支持多工具整合的开源流程自动化框架,后者是闭源的垂直代码AI助手。DeerFlow优势在于开源定制、全流程整合和私有化部署,但代码能力依赖外部模型;Claude-code专精代码场景且开箱即用,但受限于厂商生态。选型建议:需复杂流程/数据安全选DeerFlow;追求代码专项能力选Claude-code;两者可组合使用实现互补。核心差异在于框架灵活性与场景专精的权衡。(149字)原创 2026-04-04 11:13:35 · 540 阅读 · 0 评论 -
Claude Code 源码泄露深度剖析:Anthropic AI 编程助手的架构全解密
Claude Code 源码架构深度解析 核心设计亮点 极致性能优化 采用动态import和并行预取技术 关键路径零模块加载设计 启动阶段并行执行MDM和Keychain读取 多层安全防护 6层权限检查机制 反调试检测和静默退出 路径拦截和文件黑名单防护 精简高效架构 仅34行自研状态管理核心 无第三方状态库依赖 基于Object.is的变更检测 灵活扩展能力 43个工具统一接口注册 支持5种传输协议接入 4种执行方式的Hook系统 智能上下文管理 三种压缩策略应对窗口限制 LRU缓存和去重机制 工具结果预原创 2026-04-03 17:53:08 · 625 阅读 · 0 评论 -
Claude源码泄露事件深度解析:从“炼丹术”到“工程学”的行业变革
摘要: 2026年3月,Anthropic公司意外泄露了Claude智能体的核心源码,揭示了AI行业从"黑箱炼丹"向系统化工程转型的关键趋势。泄露的51万行代码暴露了三大核心技术:多智能体协同架构、动态上下文管理系统和未来研发中的主动式AI技术(如"梦境学习"机制)。这场泄露事件颠覆了行业认知,证明当前AI应用的卓越表现80%依赖于工程化设计而非模型本身。事件将加速AI技术民主化,中小开发者可通过复现泄露的工程架构,用开源模型构建接近商业级的产品。未来AI竞争焦点将从原创 2026-04-02 15:35:52 · 436 阅读 · 1 评论
分享