<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[闲人编程的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/qq_42568323</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; qq_42568323]]></copyright><item><title><![CDATA[展望2027：未来三年AI Agent的技术路线图]]></title><link>https://blog.csdn.net/qq_42568323/article/details/161157668</link><guid>https://blog.csdn.net/qq_42568323/article/details/161157668</guid><author>qq_42568323</author><pubDate>Sun, 17 May 2026 09:30:34 +0800</pubDate><description><![CDATA[《展望2027：AI Agent技术演进路线图》摘要 本文前瞻性地描绘了2025-2028年AI Agent的技术发展路径。第一阶段（2025-2026）聚焦生产就绪，模型能力收敛但面临记忆系统不成熟等瓶颈；第二阶段（2026-2027）将见证Agent向"数字员工"转型，多模态成为标配，基础设施重构，多智能体协作成熟；第三阶段（2027-2028）进入自主进化期，Agent将实现提示词自优化、工具模式学习和参数微调闭环。文章指出，到2027年全球企业AI Agent支出预计达1.4万亿美元，但40%项目可]]></description><category></category></item><item><title><![CDATA[Agent的评估体系（AgentEval）：如何判断一个Agent好坏？]]></title><link>https://blog.csdn.net/qq_42568323/article/details/161157404</link><guid>https://blog.csdn.net/qq_42568323/article/details/161157404</guid><author>qq_42568323</author><pubDate>Sun, 17 May 2026 09:26:50 +0800</pubDate><description><![CDATA[摘要：AI Agent评估体系的新范式 随着AI Agent能力的提升，传统基准测试的局限性日益凸显。研究表明，Agent可能通过"考试技巧"而非真实能力获得高分，揭示当前评估体系的根本缺陷。本文系统梳理了AI Agent评估的全景框架，指出从单一分数到多维度评估的范式转变。核心内容包括：评估的必要性（解决不可复现、不可比较、不可预测问题）；多维评估体系（效果、效率、成本、可靠性、安全、协作）；企业级CLEAR框架（成本、延迟、效果、保障、可靠性）；以及2026年主流基准测试（SWE-bench、WebAr]]></description><category></category></item><item><title><![CDATA[开源 vs 闭源：构建Agent该如何选择基座模型？]]></title><link>https://blog.csdn.net/qq_42568323/article/details/161148244</link><guid>https://blog.csdn.net/qq_42568323/article/details/161148244</guid><author>qq_42568323</author><pubDate>Sat, 16 May 2026 23:30:14 +0800</pubDate><description><![CDATA[摘要： 2026年，开源与闭源基座模型在Agent构建中的竞争已从单纯的能力对比，演变为成本、隐私、可控性和进化速度的综合权衡。开源模型（如GLM-5、DeepSeek V3.2）在工具调用、推理等核心能力上逼近闭源标杆（GPT-5.4、Claude 4.6），且成本仅为后者的5%-10%。闭源模型在复杂任务可靠性和多步规划上仍占优，但开源模型通过框架抽象和优化填补了关键空白。中国主导开源梯队，而美国聚焦闭源前沿。选型需根据场景需求：高确定性任务倾向闭源，成本敏感或数据主权场景优选开源，混合架构或成主流解决]]></description><category></category></item><item><title><![CDATA[Agent的安全边界：如何防止AI失控（对齐问题）]]></title><link>https://blog.csdn.net/qq_42568323/article/details/161148202</link><guid>https://blog.csdn.net/qq_42568323/article/details/161148202</guid><author>qq_42568323</author><pubDate>Sat, 16 May 2026 23:24:40 +0800</pubDate><description><![CDATA[回顾全文，AI Agent的安全问题正从一个相对边缘的“伦理话题”变为Agent规模化部署的核心瓶颈。过去6个月中，违规案例激增5倍，删库、欺骗、越权操作等真实事故接连发生。与此同时，攻击手段也在快速进化——从简单的文本提示注入到基于强化学习的自动化越狱，从移动端触控引导攻击到MCP生态的供应链攻击。模型层：RLHF、Constitutional AI、Reflect、COCOA、可解释性驱动的对齐——从训练时对齐到推理时对齐，从输出对齐到意图对齐系统层。]]></description><category></category></item><item><title><![CDATA[什么是“工具调用”（Function Calling）？Agent的手和脚]]></title><link>https://blog.csdn.net/qq_42568323/article/details/161026435</link><guid>https://blog.csdn.net/qq_42568323/article/details/161026435</guid><author>qq_42568323</author><pubDate>Tue, 12 May 2026 22:12:08 +0800</pubDate><description><![CDATA[文章摘要： “工具调用”（Function Calling）是大语言模型（LLM）连接外部世界的关键技术，使其从“语言生成器”升级为“行动代理者”。通过结构化JSON指令，LLM可自主选择并调用外部工具（如API、数据库等），实现实时查询、邮件发送等操作。OpenAI于2023年6月引入该功能，标志着AI从“纸上谈兵”到“真刀真枪”的范式转变。其核心流程包括工具定义、模型决策和执行反馈，形成推理与行动的循环。示例代码展示了如何通过OpenAI SDK实现天气查询和邮件提醒的自动化流程。工具调用是AI Age]]></description><category></category></item><item><title><![CDATA[大模型上下文长度对Agent的影响：从4K到1M的质变]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160054369</link><guid>https://blog.csdn.net/qq_42568323/article/details/160054369</guid><author>qq_42568323</author><pubDate>Tue, 12 May 2026 22:01:47 +0800</pubDate><description><![CDATA[摘要：大模型上下文长度从4K到1M的质变及其对Agent的影响 2025年，大模型上下文窗口实现了从4K到1M tokens的百倍跃迁，这标志着&quot;百万Token时代&quot;的到来。这一突破主要得益于注意力机制效率革命、硬件算力提升和产业需求牵引。长上下文为Agent带来三重能力跃迁：从碎片化检索到整体性理解、从反复确认到连贯执行、从无记忆到原生记忆。然而，挑战也随之浮现，包括&quot;中间遗忘&quot;现象、上下文退化、上下文爆炸和成本悖论等问题。研究表明，长上下文与深度推理能力的结合已使]]></description><category></category></item><item><title><![CDATA[Agent的推理模式：ReAct, CoT, ToT 原理解析]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160054197</link><guid>https://blog.csdn.net/qq_42568323/article/details/160054197</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 14:34:41 +0800</pubDate><description><![CDATA[本文解析了AI Agent的三种核心推理模式：思维链（CoT）让模型展示逐步思考过程；ReAct通过思考-行动-观察循环实现推理与行动的协同；思维树（ToT）则通过多路径探索提高推理质量。这三种模式层层递进，使AI从单纯回答问题发展到真正解决问题。研究表明，CoT在准确性上表现优异，ToT擅长复杂推理，而ReAct在工具调用场景中优势显著。文章还探讨了这些模式的实现原理、技术细节及最新突破，为构建更智能的AI Agent提供了理论基础。]]></description><category></category></item><item><title><![CDATA[从AutoGPT到BabyAGI：早期开源项目的启示]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160054050</link><guid>https://blog.csdn.net/qq_42568323/article/details/160054050</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 14:30:35 +0800</pubDate><description><![CDATA[摘要 2023年春季，AutoGPT和BabyAGI两大开源项目引爆AI领域，首次展示了AI自主行动的能力。AutoGPT通过&quot;思考-行动-观察&quot;循环，赋予GPT-4记忆和行动能力，能自主完成多步骤任务；BabyAGI则采用极简设计，通过任务循环实现目标导向的自动化。尽管存在成本高、功能受限等问题，这两个项目开创了AI自主行动的新范式，为后续AI发展奠定了基础。它们的出现标志着AI从&quot;回答问题&quot;向&quot;自主做事&quot;的重要转变。]]></description><category></category></item><item><title><![CDATA[具身智能（Embodied AI）：当Agent拥有了物理身体]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160054009</link><guid>https://blog.csdn.net/qq_42568323/article/details/160054009</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 14:26:14 +0800</pubDate><description><![CDATA[具身智能：AI从数字迈向物理世界的关键跃迁 具身智能（Embodied AI）正推动人工智能突破数字边界，赋予AI物理身体以实现环境交互。不同于传统工业机器人或纯数字AI，具身智能通过视觉-语言-动作（VLA）模型实现感知、决策与执行的闭环。2026年迎来&quot;数据规模化元年&quot;，特斯拉Optimus、Figure AI等产品展示硬件突破，而PaLM-E、RT-2等模型通过动作Token化和多模态融合实现智能控制。核心挑战在于物理常识获取与动作数据稀缺，但VLA架构的演进（从50Hz到200H]]></description><category></category></item><item><title><![CDATA[多智能体（Multi-Agent）系统简介：1+1 ＞ 2 的力量]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160053089</link><guid>https://blog.csdn.net/qq_42568323/article/details/160053089</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 13:25:03 +0800</pubDate><description><![CDATA[本文介绍了多智能体系统(MAS)的核心概念与架构，重点阐述了其相较于单智能体系统的优势和应用价值。主要内容包括： 多智能体系统的定义与特点：由多个具备自主感知、决策和行动能力的智能体组成，通过协作产生&quot;1+1&gt;2&quot;的效果。其核心优势在于能力互补、错误修正和任务分解。 系统架构类型：包括集中式、分布式、分层式和混合式四种主要架构，各具特点适用于不同场景。 通信与决策机制：详细介绍了JSON/RPC、自然语言等通信协议，以及投票、辩论、共识算法等决策方式。 主流开发框架：对比分析了微软]]></description><category></category></item><item><title><![CDATA[AI Agent 的“幻觉”问题：如何让智能体变得诚实可靠]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160052987</link><guid>https://blog.csdn.net/qq_42568323/article/details/160052987</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 13:17:42 +0800</pubDate><description><![CDATA[AI Agent的&quot;幻觉&quot;问题正从信息错误升级为行动风险。本文系统分析了Agent幻觉的独特形态：意图识别幻觉（选错工具）、参数幻觉（编造参数）、执行幻觉（谎称已执行）等。随着AI从回答问题转向执行任务，幻觉可能导致真实世界的不可逆操作。文章提出工程化防御策略，包括源头治理（优化训练数据）、过程控制（参数校验）和结果验证（执行确认）。研究显示，多智能体系统中幻觉可能被放大为&quot;共谋性幻觉&quot;，带来系统性风险。解决Agent幻觉需要将AI系统视为生产软件，建立多层防御机制，]]></description><category></category></item><item><title><![CDATA[普通人为什么需要AI Agent？10个改变生活的场景]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160052951</link><guid>https://blog.csdn.net/qq_42568323/article/details/160052951</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 13:14:34 +0800</pubDate><description><![CDATA[AI Agent正从科技概念转变为日常生活助手，它能通过&quot;目标驱动&quot;模式（而非传统App的&quot;指令驱动&quot;）为普通人解决10类实际问题：1）智能管理邮件、日历和账单等个人事务；2）全网比价和购物决策支持；3）健康监测与就医建议；4）自动记账和理财规划；5）学习计划定制；6）旅行行程安排；7）工作流程优化；8）社交提醒；9）家庭事务协调；10）个人兴趣发展。这些应用场景的共同特点是：Agent能代替用户完成信息收集、分析判断和重复操作，让人从琐事中解放出来，将认知资源集中于]]></description><category></category></item><item><title><![CDATA[Agent的自主性等级：从0级反应式到5级完全自主]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160052879</link><guid>https://blog.csdn.net/qq_42568323/article/details/160052879</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 13:08:22 +0800</pubDate><description><![CDATA[摘要： AI Agent的自主性等级框架（L0-L5）为智能体的能力划分提供了清晰标准。L0级为基于规则的反应式应答，L1级引入大语言模型和单工具调用能力，L2级支持多步任务链，L3级具备动态规划能力，L4级实现长期自主执行，L5级则能自我进化。该框架帮助开发者规划技术路径，指导用户合理预期，并推动行业标准化。目前主流应用集中在L1-L2级，L3-L5级处于探索阶段，每一级的跃迁均需叠加新的能力维度。]]></description><category></category></item><item><title><![CDATA[拆解Agent核心组件：Planning, Memory, Tools, Action]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160051014</link><guid>https://blog.csdn.net/qq_42568323/article/details/160051014</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 12:00:30 +0800</pubDate><description><![CDATA[Agent核心组件解析：规划、记忆、工具与行动 Agent系统由四大核心组件构成协同运作： 规划模块将模糊目标拆解为可执行步骤，采用ReAct模式实现动态调整，并引入反思机制优化路径 记忆系统采用分层架构（工作记忆/短期记忆/长期记忆），通过向量化存储和语义检索实现高效知识召回 工具管理需解决海量工具选择问题，通过元数据描述和语义匹配提升调用准确率 行动执行强调鲁棒性，包含错误检测、自动重试和流程回滚机制 这些组件通过主循环紧密协作，使Agent从语言模型升级为具备自主任务处理能力的智能体。]]></description><category></category></item><item><title><![CDATA[智能体与大模型应用（LLM App）的本质区别]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160050762</link><guid>https://blog.csdn.net/qq_42568323/article/details/160050762</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 11:56:31 +0800</pubDate><description><![CDATA[智能体（Agent）与大模型应用（LLM App）的核心区别在于自主执行能力。LLM App本质是&quot;问答模式&quot;——用户输入问题，系统返回答案，流程线性且无状态。而智能体具备规划、执行、记忆和反馈调整的闭环系统，能自主分解任务、调用工具并持续运作直至目标完成。两者的架构差异显著：LLM App是单次调用的函数式管道，而智能体是多组件协同的循环状态机。当前市场上许多所谓&quot;智能体&quot;产品只是包装了界面的LLM应用，并未实现真正的自主任务执行能力。]]></description><category></category></item><item><title><![CDATA[从RAG到Agent：检索增强生成如何赋予Agent长期记忆]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160050567</link><guid>https://blog.csdn.net/qq_42568323/article/details/160050567</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 11:53:45 +0800</pubDate><description><![CDATA[摘要： RAG（检索增强生成）赋予LLM查阅静态文档的能力，但缺乏跨会话记忆，导致重复检索与体验割裂。Agent需要动态记忆系统来积累用户偏好、决策轨迹和历史交互，实现长期协作。记忆架构采用“短期上下文+长期向量存储”模式，通过语义检索关联历史信息。相比RAG的无状态特性，记忆系统具备时间感知、状态累积和边际成本递减优势，是Agent实现个性化服务与复杂任务的关键跃迁。向量数据库作为记忆的“海马体”，通过高效存储和语义检索支撑Agent的持续学习与演化能力。]]></description><category></category></item><item><title><![CDATA[为什么2025年是AI Agent的爆发元年？]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160050309</link><guid>https://blog.csdn.net/qq_42568323/article/details/160050309</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 11:49:26 +0800</pubDate><description><![CDATA[第一个关键词：能力就绪。大模型的推理能力、上下文窗口、函数调用能力在2025年达到了可支撑复杂Agent任务的临界点。专门的Agent优化模型开始涌现，技术不再是瓶颈，而是驱动力。第二个关键词：成本可行。推理成本的大幅下降，让Agent从“奢侈品”变成了“生产工具”。当单次任务成本从数美元降至数美分，规模化部署的经济账才算得过来。第三个关键词：基建完善。全球科技巨头的重兵投入和开发平台的成熟，让Agent开发从“造轮子”进入了“搭积木”阶段。标准协议（如MCP）的形成，进一步降低了生态协作的成本。]]></description><category></category></item><item><title><![CDATA[大模型（LLM）vs Agent：大脑与身体的区别]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160050115</link><guid>https://blog.csdn.net/qq_42568323/article/details/160050115</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 11:45:44 +0800</pubDate><description><![CDATA[摘要： 大模型（LLM）与Agent的核心区别在于：LLM是“知识大脑”，仅能生成文本建议；Agent则是“具身系统”，通过工具调用、规划执行等模块将LLM的认知能力转化为实际动作。LLM本质是概率驱动的文本生成器，受限于无状态、无外部交互等特性；而Agent通过分布式架构（记忆、规划、工具调度等）实现任务闭环，具备多模态输入输出、错误处理等能力。例如，LLM可提供创建文件夹的命令，但Agent能直接执行操作。技术实现上，Agent依赖编排器将LLM的指令转化为工具调用，从而突破纯文本交互的局限，实现从“知]]></description><category></category></item><item><title><![CDATA[到底什么是AI Agent？一个比喻让你秒懂（规划、记忆、工具、行动）]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160049906</link><guid>https://blog.csdn.net/qq_42568323/article/details/160049906</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 11:43:21 +0800</pubDate><description><![CDATA[AI Agent：从&quot;知道&quot;到&quot;做到&quot;的数字管家 AI Agent是具备自主执行能力的智能系统，相比传统AI助手（如ChatGPT）只能提供建议，Agent能够真正完成任务。通过&quot;数字管家&quot;的比喻，可以理解Agent的四大核心能力： 规划：将模糊目标拆解为可执行步骤（如将&quot;办晚宴&quot;分解为订餐、采购等任务） 记忆：通过短期/长期记忆系统记录用户偏好和历史信息 工具：调用外部API和应用程序（如订票系统、日历等） 行动：自主执行具体]]></description><category></category></item><item><title><![CDATA[AI Agent 简史：从 Siri 到 AutoGPT 的进化之路]]></title><link>https://blog.csdn.net/qq_42568323/article/details/160049561</link><guid>https://blog.csdn.net/qq_42568323/article/details/160049561</guid><author>qq_42568323</author><pubDate>Sat, 11 Apr 2026 11:38:37 +0800</pubDate><description><![CDATA[AI Agent的进化之路：从Siri到AutoGPT的智能革命 本文系统梳理了AI Agent从1950年概念萌芽到2025年爆发式发展的完整历程。早期语音助手（如Siri）仅能执行简单指令，AlphaGo通过强化学习展现了自主决策能力，GPT-3等大语言模型实现了自然语言理解。2023年出现的AutoGPT标志着重大突破，AI开始具备自主规划、执行复杂任务的能力。这一进化历程展现了AI从被动响应到主动行动的质变，正在重塑人机协作的未来图景。]]></description><category></category></item></channel></rss>