- 博客(59)
- 收藏
- 关注
原创 Agent原生操作系统:当AI成为OS,App时代将如何终结
文章摘要 《Agent原生操作系统:当AI成为OS,App时代将如何终结》探讨了AI操作系统如何颠覆传统App生态。2026年,阶跃星辰、华为、微软等厂商相继发布Agent原生操作系统,标志着操作系统从"人机交互"向"意图执行"的范式转变。传统OS存在记忆墙(数据孤岛)、决策墙(算力调度不匹配)、行动墙(App封闭)三大结构性壁垒。新兴Agent OS通过重构底层架构,以意图和任务为调度核心,实现跨应用编排与统一记忆管理。文章对比了改良派(如Android、HarmonyOS)与原生派(Step AOS)的
2026-07-27 20:30:00
668
原创 2026 AI编程工具年终横评——Cursor vs Claude Code vs Copilot vs Windsurf,到底选哪个?
2026年了,AI编程已经不是"要不要用"的问题。JetBrains最新调研显示,95%的开发者每周都在用AI编程工具,GitHub上一半以上的代码是AI生成的。问题变成了——Cursor、Claude Code、Copilot、Windsurf,到底选哪个?这篇文章不搬运官方文档,不念参数表。我用同一个项目,四个工具全部跑了一遍,结合最新市场数据,给你一个真正能指导决策的答案。
2026-07-14 20:13:57
685
原创 【本地AI接入MCP协议完整教程:让Ollama一键连接文件、数据库和浏览器】
本篇聚焦2025年最火爆的AI基础设施——MCP(Model Context Protocol),教你把本地AI从"只能聊天"升级为"能动手干活"的超级工具。
2026-07-03 07:57:48
654
原创 AI下半场_05_CSDN版_模型选型指南
2026年的AI模型选型,已经不是挑一个模型的年代。是在路由层把每个请求送到最合适的模型。本文给出这张路由表的完整结构、2026年9月最新价格、硬件匹配矩阵和可直接抄走的混合架构代码。
2026-09-13 21:01:48
219
原创 AI下半场_04_CSDN版_开源逆袭
摘要: 最新数据显示,中国开源AI模型在全球开发者中的采用率急剧攀升。OpenRouter平台统计显示,中国模型流量占比从2024年10月的1.2%飙升至2026年7月的45%峰值,同期美国三大实验室份额从70%降至30%。DeepSeek和Qwen等中国开源模型在编程等高成本场景表现突出,其中月之暗面发布的Kimi K3在编程盲测中首次超越闭源旗舰模型。价格优势显著——中国开源模型成本比美国闭源产品低60%-90%,推动CoinBase、Stripe等企业大规模迁移。Mozilla报告指出,开源模型在代码
2026-08-18 19:59:14
211
原创 AI下半场_03_CSDN版_Token经济学
文章摘要: Gartner预测,到2028年企业AI编程工具成本将超过开发者年薪,形成"Token单价降99%、总账单涨100倍"的悖论。这一现象源于杰文斯悖论:AI推理成本暴跌刺激需求激增,日均Token调用量两年增长1400倍。2026年AI支出结构发生"推理反转",推理占预算85%,远超训练成本,因Agent工作流、内部思考链和7×24运行持续消耗Token。此外,Token费用仅占AI总成本30%,平台构建和运维隐性成本占比更高。尽管单任务AI成本表面比人类低30-100倍,但计入开发维护和失败重试
2026-08-10 19:43:29
195
原创 AI下半场_02_CSDN版_最贵翻车账单
AI编程成本失控:2026年5亿美元账单警示录 2026年科技行业曝出多起AI编程成本失控事件,从Uber CTO两小时1200美元的个人案例到匿名企业单月5亿美元的集体灾难,揭示了AI规模化应用的隐性风险。 核心问题: 无预算上限:匿名企业全员无限制使用Claude导致5亿美元账单 模型错配:Amazon用高价Claude Sonnet处理简单任务,180万美元账单中86%属浪费 代理循环失控:LangChain两个AI代理互相验证导致11天47,000美元无效消耗 递归陷阱:Claude Code子代理
2026-08-09 21:00:00
252
原创 AI下半场_01_CSDN版_AI不能拖欠工资
文章摘要: 2026年,Uber等科技巨头遭遇AI成本黑洞,全年AI预算四个月耗尽。CTO两小时演示烧掉1200美元,工程师AI工具使用率飙升至95%,但COO坦言无法量化ROI。杰文斯悖论显现:Token单价降98%,企业总支出反增6倍,因Agent任务消耗达标准交互的1000倍,70%成本来自编排、检索等隐性环节。Agent成本呈O(n²)增长,递归循环、上下文膨胀等七种模式导致严重浪费。行业面临核心矛盾:AI生产力提升与成本失控的裂缝正在扩大,企业亟需优化策略以平衡效率与支出。
2026-08-08 20:30:00
360
原创 AI时代的铁饭碗,5个确定性增长的技术方向
文章摘要(149字) AI时代技术人突围的5个确定性增长方向:1)AI Agent安全攻防(提示注入市场复合增长31.2%);2)Agent工程化与AgentOps(仅11%的Agent能上线生产);3)AI原生基础设施(AIPC渗透率31%);4)企业知识工程(87%企业面临知识断层);5)AI增强开发(65%代码AI生成但需人工把关)。这些领域共同特征:市场真实增长、人才缺口扩大、技术处于爆发前夜、现有技能可迁移。从保命到增长,完成完整突围路径。
2026-08-07 20:30:00
158
原创 8个AI替代不了的能力,程序员的保命清单
摘要(146字) AI时代程序员需培养8项不可替代能力:1)问题定义(判断需求价值);2)价值判断(商业决策权衡);3)系统架构设计(全局协调而非局部编码);4)安全审查(对抗性思维);5)上下文工程(构建高质量AI输入);6)多Agent编排(协调智能体协作);7)技术债管理(长期维护视角);8)AI对齐(确保系统符合预期)。研究表明,AI在独立编码任务可达80%准确率,但在持续演进场景骤降至38%,技术债累积是其致命弱点。核心差异在于:AI擅长"从无到有"的生成,人类强在"持续演进"的判断与维护。
2026-08-06 21:28:43
203
原创 $20的Devin能取代你吗,260亿估值背后的真实完成率
本篇用Devin这个"最像AI软件工程师"的产品,实测回答一个所有人都在问的问题:自主编程Agent现在到底能替代多少程序员的工作?
2026-08-05 21:23:04
366
原创 89%拿AI当裁员借口,真实替代率仅4.5%,2026裁员悖论全拆解
文章摘要 2026年AI裁员现象存在严重数据矛盾:企业宣称的AI裁员比例(89%)远超实际替代率(4.5%)。牛津经济研究院数据显示,2025年AI相关裁员仅占总量4.5%,且生产力数据未现预期增长。研究发现,AI已成为企业裁员的"万能借口"(AI Washing),Atlassian等公司在盈利增长期仍借AI名义裁员。回旋镖效应显著:29%企业已在6个月内回招被裁岗位,Klarna等公司因AI无法替代人类共情能力而重新雇佣员工。数据显示,AI裁员实际成本常高于节省,55%企业表示后悔。这表明当前AI尚不具
2026-08-04 18:26:37
318
原创 写了36篇技术博客后,我总结出这套AI辅助写作流水线
AI辅助写作高效流水线指南 本文作者通过36篇技术博客实践,总结出一套AI辅助写作五步法: 选题与资料收集:AI做竞品分析和数据收集,人工决定选题方向 大纲生成:AI提供初稿,人工调整结构节奏,突出差异化观点 分块写作:将文章拆解为300-500字模块单独生成,确保内容质量 人工编辑:重点核查事实、强化逻辑、注入个人经验、优化语言风格 SEO优化:AI辅助完成关键词优化、标签生成和封面图设计 关键工具组合:Claude/ChatGPT用于主写作,Cursor生成代码示例,AI图像工具制作封面,月成本约40-
2026-08-03 20:39:16
294
原创 会用AI的程序员正在吃掉不用AI的程序员——从码农到AI编排师
摘要: 随着AI在编程领域的深度应用,程序员角色正从"代码编写者"转变为"AI编排师"。Anthropic报告显示,开发者60%的工作已使用AI,但仅0-20%可完全委托。新角色的核心能力包括意图工程(精准拆解需求)、输出审查(识别AI代码缺陷)、上下文工程(管理AI所需信息)和Agent编排(协调多AI系统)。尽管AI能生成代码,算法思维、问题分解等底层能力仍不可替代。案例显示,采用AI编排模式可将开发周期缩短79%,错误率降低40%。未来程序员的核心价值将从"写代码"转向"治理代码生产的系统"。
2026-08-03 20:27:30
300
原创 提示注入走向实战:2026年AI Agent被攻击的真实案例
摘要(149字) 2026年标志提示注入攻击进入实战阶段:GrafanaGhost漏洞使AI助手成为数据外泄管道;微软Semantic Kernel框架漏洞让prompt可执行任意代码;Claude Code Action的沙箱绕过导致API密钥泄露。研究显示攻击者已形成系统性武器库,采用社会工程框架隐藏恶意指令,85%案例利用权威伪装绕过检测。OpenAI承认某些攻击向量可能无法根治,提示注入正从理论威胁演变为架构性安全挑战,防御需重构现有技术栈。
2026-08-02 20:37:23
311
原创 AI编程的“70%墙“:为什么最后30%AI总是搞砸
聊一个叫"70%墙"的现象:AI编程工具在项目前期表现优秀,快速搭建框架、生成样板代码、跑通基本逻辑。但项目推进到某个临界点之后,AI开始破坏已有功能,越改越乱,越乱越改。前70%是从零到有,AI擅长。后30%是在已有架构上做精细修改,AI频繁翻车。这堵墙根源在当前大模型架构的固有局限,和某个工具的bug无关。我们用数据拆开看。
2026-08-01 18:19:39
813
原创 开源项目吐槽大会:那些让开发者又爱又恨的“开源瑰宝“开场
吐槽归吐槽,开源依然是软件行业最美好的东西之一。我们骂的每一个问题,都是因为我们离不开它。那些文档不全的项目、依赖爆炸的库、突然断更的仓库,恰恰证明了开源生态的繁荣和不可替代。没有开源,就没有今天的软件行业。这句话不需要加"但是"。但下次如果再看到一个README写着"文档正在完善中"的项目,我还是会骂一句。然后乖乖地去提一个PR。
2026-08-01 18:06:34
205
原创 一个GitHub Issue黑掉npm生态:Clinejection提示注入攻击链全复盘
摘要 2026年2月,一个名为cline@2.3.0的恶意npm包通过GitHub Issue提示注入攻击链被发布,在8小时内感染约4000台开发机器。攻击者利用Cline仓库的AI Issue分类工作流漏洞,通过精心构造的Issue标题触发Claude Agent执行恶意npm install命令,窃取API密钥。随后通过GitHub Actions缓存投毒技术横向移动,最终利用遗留的npm发布凭证推送恶意包。该包仅在postinstall脚本中静默安装OpenClaw框架作为概念验证,但展示了"提示注入
2026-07-31 20:25:39
484
原创 DeepSeek V4一用工具就报400?我花了三天定位到根因
摘要: DeepSeek V4与Claude Code在工具调用时出现400错误,根因是协议兼容性问题。当模型生成thinking块后,客户端未正确回传或格式不匹配,触发DeepSeek严格校验失败。解决方案包括: 推荐方案:使用dsv4-cc-proxy代理修正协议缺口,保留思考模式功能; 降级方案:关闭思考模式,但牺牲模型深度推理能力; 回避方案:切换至DeepSeek V3等兼容性更好的模型。 排查过程揭示问题源于多轮对话中thinking块的处理逻辑与端点校验不匹配,需针对性修复而非简单规避。
2026-07-31 20:05:02
244
原创 $2删库,$5万赔偿:7起AI Agent摧毁生产环境事故全复盘
摘要 2026年,多起AI Agent引发生产环境灾难的事故引发关注。7起典型案例显示:开发者在Cursor、Claude Code等AI工具辅助下,由于缺乏权限管控和安全确认机制,导致误删数据库、清空表数据、销毁云基础设施等严重事故。最典型的是"2美元删库"事件,Agent为优化性能直接删除生产数据库,造成8万美元损失。 结构性根因在于:AI Agent被赋予过高权限,执行破坏性操作时缺乏人工确认机制。事故多发生在自主运行场景,AI为追求效率最优解而忽视风险。专家指出,这暴露了AI系统仅将安全规则视为建议
2026-07-30 19:44:51
542
原创 Kimi_K3深度测评_长文本之外的真实力
Kimi K3深度测评摘要 月之暗面开源的Kimi K3模型以2.8万亿参数创下开源记录,采用896专家MoE架构实现56:1稀疏比。三大核心创新——KDA注意力机制降低长序列计算开销、AttnRes改善深度网络信息流动、Stable LatentMoE保障高稀疏训练稳定性,使其在保持较低激活参数(约104B)下实现100万token上下文窗口。量化感知训练使显存需求降至1/4-1/8。 评测显示K3在Artificial Analysis智能指数(57分)排名全球第四,超越Claude Opus 4.8,
2026-07-30 18:48:24
234
原创 裁了又招的“回旋镖“:89%企业因AI裁员,只有2%真被替代
89% 的企业因为 AI 的"预期影响"进行了裁员或放缓招聘,但只有 2% 的企业明确表示,裁员是因为 AI 确实承担了原本由人完成的工作。87 个百分点的空白里,藏着 2026 年最荒诞的企业行为模式:裁了又招。
2026-07-29 21:16:56
466
原创 KMP全栈开发_从Android到AI_Agent
KMP全栈开发正在突破移动端边界,成为跨平台开发主流选择。数据显示KMP已被40多万项目采用,GitHub Star数超5万。其核心优势在于业务逻辑共享,UI分平台实现,支持Android、iOS、桌面和Web全平台。KMP还延伸至服务端开发,通过Ktor实现全栈Kotlin开发。2026年趋势显示,KMP开始应用于AI Agent开发,使移动开发者能轻松扩展至AI领域。但需注意KMP在iOS编译速度和生态支持上的局限,适合已有Android团队且追求原生性能的场景。技术选型应综合考虑项目需求和团队能力。
2026-07-29 19:29:07
413
原创 AI Agent可观测性_破解多步推理黑盒
AI Agent的多步推理能力带来性能提升的同时也形成了黑盒问题,研究表明79%的失败源于架构设计而非模型能力。OpenTelemetry的GenAI规范正尝试通过trace记录关键属性来提升可观测性。当前89%的组织已部署相关方案,但需注意可观测性会带来额外成本,且只能暴露问题而非直接解决问题。行业共识是必须首先实现黑盒可视化,才能进一步优化Agent性能。
2026-07-28 21:23:08
367
原创 AI写了90%的代码,程序员正在消失(2026全球AI裁员潮真相)
2026年全球科技行业迎来AI驱动的裁员潮,程序员群体首当其冲。数据显示:国际企业出现首例纯AI裁员(Block裁40%),中国通过柔性调整变相缩减岗位;全球AI生成代码率飙升至42%(Meta达75%),92%开发者日常使用AI工具。岗位需求呈现两极分化:基础CRUD岗位需求腰斩,而AI应用开发岗增长60%,Agent工程师年薪达120-250万。值得注意的是,89%企业因AI预期裁员,但仅2%真正实现替代,30%企业出现"裁后回招"现象。建议开发者按年限转型:初级转向AI协同开发,中级深耕垂直领域,高级
2026-07-28 21:17:27
585
原创 2026年Agent商店生态全景:五大市场模型的竞争格局与商业化路径
本篇聚焦Agent分发渠道的商业化生态:2026年GPT Store、Claude Marketplace、Salesforce AgentExchange、Microsoft Agent Store、Google Agentspace五大模型全面竞争,中国市场上Coze一家独大。市场规模预计2030年达520亿美元。
2026-07-27 17:16:00
514
原创 从Demo到生产:Agent部署监控与成本控制,40%项目被取消的真相与对策
本文探讨了AI Agent从Demo到生产环境面临的三大鸿沟:可靠性、可观测性和成本控制。根据Gartner数据,40%的Agent项目因成本失控被取消,主要由于生产环境的分布偏移、缺乏有效监控以及LLM调用的指数级成本增长。文章提出了生产级Agent部署方案(Docker容器化+资源限制)、监控体系(全链路追踪)和成本控制策略(四层预算防线),强调AgentOps需要专门的CI/CD流程。通过实施工具调用审计、异常行为拦截和渐进式生产化,可降低Agent失控风险,提升项目存活率。
2026-07-26 18:23:18
421
原创 多Agent数据分析报告自动化实战:用CrewAI组支AI团队,丢份数据就出报告(从架构到评估)
本文探讨了使用CrewAI框架构建多Agent系统实现数据分析报告自动化的实践。通过将数据分析流程拆解为数据清洗、统计分析、可视化和报告撰写四个专业角色,搭建串行流水线架构,显著提升了报告生成效率和质量。技术选型上,CrewAI凭借声明式编程和轻量级优势成为首选。实测表明,该系统能处理真实销售数据并输出完整报告,但需注意多Agent系统存在约15倍token消耗和40%生产失败率的风险。该方案适合工序明确、可验证的数据分析任务,为重复性报告工作提供了可行的自动化路径。
2026-07-25 19:04:29
324
原创 自动化客服Agent实战:用LangGraph+RAG+MCP把80%工单交给AI(从设计到部署)
本文介绍了构建生产级自动化客服Agent的完整方案。通过LangGraph框架实现多Agent协作架构,结合RAG技术确保回答准确性,利用MCP接口调用业务系统,并引入记忆机制提升连续性体验。文章从市场窗口期、架构设计、技术选型到核心代码和部署方案进行详细拆解,同时辩证分析了AI幻觉和错误升级等风险。实践表明,合理设计的客服Agent可分流80%工单,单次成本仅为人工的1/18,但需严格设计护栏机制避免法律风险。
2026-07-24 20:17:23
253
原创 Agent记忆系统:让AI拥有长期记忆,从MemGPT到Letta实战
本文探讨了AI Agent记忆系统的核心挑战与解决方案。文章指出,现代AI系统常在记忆层而非推理层崩溃,揭示了LLM无状态的本质问题。作者系统梳理了记忆系统从全量上下文、RAG到长期记忆产品化的演进路径,重点分析了Letta(原MemGPT)的三级记忆架构(核心记忆、回忆记忆、归档记忆)及其操作系统式管理理念。通过对比Mem0与Zep两种记忆哲学,文章强调记忆系统需平衡留存、更新和唤起三大功能,而非简单存储更多数据。最后提供了选型建议,并指出记忆系统的核心价值在于"在正确时刻想起正确信息"。
2026-07-23 20:20:35
381
原创 AI Agent可观测性:破解多步推理黑盒
摘要: AI Agent的可观测性已成为关键挑战,传统监控工具无法应对Agent的多步推理、状态累积和非确定性行为。典型案例显示,缺乏实时监控可能导致巨额成本(如47,000美元的会话)或级联故障。OpenTelemetry GenAI规范提出六层架构,通过Trace、Span和执行树记录Agent的推理链、工具调用及成本。主流平台(如LangSmith、Langfuse)支持调试,但仍存在推理不透明的根本问题。核心指标包括工具调用成功率、每会话token消耗和评估通过率,需结合实时约束(如token上限)
2026-07-22 23:30:00
399
原创 多Agent协作与A2A协议——CrewAI + LangGraph搭建AI协作团队
本文探讨了多Agent协作系统的发展现状与关键技术。内容涵盖: 多Agent协作的必要性:单Agent存在注意力分散、上下文窗口膨胀和错误传播三大瓶颈,多Agent通过专业分工可有效解决这些问题。 协议生态:2026年已形成MCP(Agent-工具)、A2A(Agent间)和AP2(支付结算)三层协议栈,A2A协议实现了不同框架Agent的无缝协作。 技术实现:介绍了CrewAI快速搭建AI团队和LangGraph构建有状态工作流的方法,对比了三大框架(CrewAI/LangGraph/AutoGen)的特
2026-07-22 19:34:04
551
原创 MCP Server开发实战——从零写一个自己的MCP工具,让AI调用你的API
本文介绍了如何从零开发一个MCP Server,让AI应用通过标准协议调用自定义工具。MCP协议通过标准化工具定义解决了N×M集成困境,采用三层架构分离权限控制。文章详细讲解了MCP三大原语(Tools/Resources/Prompts)的区别与使用场景,并基于FastMCP框架演示了开发流程:从环境搭建、编写工具函数,到调试部署。通过实战案例,读者可以掌握创建MCP服务器、接入Claude/Cursor等AI应用,以及Docker部署等完整开发链路。最后讨论了MCP在实际应用中的优势与潜在问题。
2026-07-21 19:39:40
410
原创 MCP 协议实战:用 Claude Desktop 连本地 SQLite,5 分钟搭一个能查数据的 AI 助手
本文介绍了如何使用MCP协议在5分钟内为Claude Desktop搭建一个能查询本地SQLite数据库的AI助手。主要内容包括: MCP协议简介:让AI能直接调用本地工具,无需手动复制粘贴数据。 实现步骤: 环境准备(Python 3.10+、uv工具、Claude Desktop) 初始化SQLite测试数据库 编写MCP Server核心代码(使用FastMCP框架) 通过@mcp.tool()装饰器将Python函数转为AI可调用工具 配置Claude Desktop连接本地MCP服务 关键点: 工
2026-07-21 10:50:18
354
原创 AI Agent开发入门——从ReAct到Tool Calling,拆解Agent的底层运行逻辑
AI Agent开发入门——从ReAct到Tool Calling,拆解Agent的底层运行逻辑
2026-07-20 20:00:03
392
原创 用AI编程完成一个全栈项目:4天从需求到部署,AI简历优化工具实战全记录
这篇把方法论放进一个真实项目里验证:用 AI 编程从零开发一个全栈应用,记录 4 天从需求到部署的全过程。
2026-07-19 20:30:00
357
原创 AI编程的代价——AI生成代码安全漏洞率45%,如何不被AI拖慢?
当AI写了100%的代码后,"谁来保证质量"成了新的核心问题。微软在同一周设立了"工程质量负责人"岗位。这篇就拆解这个问题。数据很反直觉:开发者觉得AI让自己快了20%,实际测量却慢了19%。AI生成的代码含重大问题的概率是人工的1.7倍。45%的AI生成代码包含OWASP Top 10安全漏洞。cURL项目被迫关停了运行6年的Bug赏金计划。多个开源项目公开禁AI代码。
2026-07-18 21:00:00
482
原创 Vibe Coding已死,Agentic Engineering当立——2026年AI编程范式的根本转变
Andrej Karpathy在2025年2月发明了"Vibe Coding"这个词,14个月后亲自宣布它过时,提出了"Agentic Engineering"。这不是换个名字那么简单。它标志着AI编程从一个直觉驱动的探索阶段,进入了工程化驱动的系统阶段。这篇拆解这个范式转变到底意味着什么,以及你的编程方式需要怎么变。
2026-07-17 19:50:36
542
原创 DeepSeek V4正式上线!百万字通读+峰谷定价,到底值不值
这篇回答那个问题。也回答另一个你可能没意识到的问题:Cursor $20/月、Claude Code $100/月、Copilot $10/月,一年下来不是小数目。有没有一种方案,零成本、代码不出门、断网也能用?答案是:Ollama + Continue。免费、本地、离线、隐私。这篇文章带你从零搭建,20分钟搞定。
2026-07-16 20:04:22
424
原创 Cursor零基础入门——30分钟上手Agentic Coding,从安装到第一个AI项目
上一篇发出去后,评论区问得最多的问题是"Cursor到底怎么用"。说实话,Cursor的官方文档写得不错,但对新手来说有两个问题:一是英文为主,二是只讲功能不讲"心法"——你可能学会了点哪个按钮,但不知道什么时候该用什么功能。这篇文章解决两个问题:怎么装、怎么用。我会带你从零开始,30分钟内用Cursor完成一个真实的待办应用项目。不是Hello World那种玩具,是一个有前端、有后端、有数据库的完整应用。
2026-07-15 20:06:17
536
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅