自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(1800)
  • 收藏
  • 关注

原创 告别AI“短期失忆“:Agent Skills让智能体拥有长期记忆,收藏必备的AI开发新范式

Anthropic推出的Agent Skills技术解决了AI智能体"短期失忆"问题,通过将复杂任务流程固化为可复用的"技能组件",使AI能按需调用能力,无需重复训练。该技术采用三层渐进式加载机制,支持跨平台使用,并已形成完整生态系统。Agent Skills不仅提高了AI工作效率,更代表了将专业知识模块化、流程化、可复用化的思维方式转变,将成为AI时代个人和组织的核心竞争力。

2026-03-27 15:02:57 517

原创 从零开始学ReAct Agent:大模型智能体的运行机制与实现技巧(值得收藏)

ReAct Agent智能体以大模型为大脑、工具为手脚,通过"思考-行动-观察"流程处理任务。由于模型存在幻觉和意图识别不明确等问题,执行过程不稳定,可能出现工具不全、执行错误等问题。因此需要通过提示词指导模型处理复杂任务的方法,限制执行次数确保系统稳定性。大模型自身能力有限,人类需参与指导其复杂任务处理能力。

2026-03-27 15:01:18 415

原创 手把手教你打造生产级RAG系统:5个核心优化点(建议收藏学习)

文章详细介绍了将RAG系统从Demo提升到生产级别的5个关键优化步骤:1)智能分块,优化文档分块策略和元数据管理;2)混合搜索,结合语义与关键词检索;3)结果重排序,提高相关文档的准确性;4)添加护栏机制,防止模型编造信息;5)建立评估体系,持续监控系统性能。强调构建生产级RAG需要循序渐进,解决检索质量与异常处理问题。

2026-03-27 15:00:15 470

原创 AI Agent开发全攻略:从玩具应用到生产级大模型解决方案

文章讨论了AI Agent开发中面临的多租户存储挑战,提出了一种名为"Agent Bucket"的创新解决方案。该方案通过引入"ObjectSet"这一新层级,解决了传统对象存储在处理海量用户数据时的隔离、权限、计量等难题。Agent Bucket提供了原生隔离、权限控制、监控计量等能力,支持亿级用户管理,适用于代码仓库、企业相册、模型托管等多种场景,为AI Agent开发者提供了高效、可扩展的存储解决方案。

2026-03-27 14:54:18 411

原创 【技术干货】AI Agent记忆系统四层架构:让大模型实现长期记忆的工程实践

大语言模型的无状态性是Agent发展的根本障碍。作者提出Agent记忆四层体系:工作记忆(上下文窗口)、情景记忆(历史记录)、语义记忆(事实知识)和程序记忆(操作方法)。记忆系统通过写入、检索和遗忘机制实现持久化存储,使Agent能保持连续性。当前Mem0、Letta等方案已实现标准化,与MCP、A2A共同构成Agent完整能力框架。记忆作为独立工程层需刻意设计,不会随模型规模增长自动获得。

2026-03-23 22:03:39 494

原创 【建议收藏】大模型推理三大核心框架全解析:CoT、ReAct与ToT,AI Agent开发必备指南

文章解析大模型推理三大框架:CoT(线性单链推理)、ReAct(推理+行动闭环)和ToT(树状多分支探索)。CoT是基础推理范式,ReAct是AI Agent核心框架,ToT代表高阶推理方向。三者形成推理能力进阶体系,各有适用场景和优缺点。开发者可根据任务复杂度、成本预算选择合适框架,ReAct+CoT是目前工业界"黄金组合"。

2026-03-23 21:58:49 858

原创 必藏!大模型开发必知:Skill才是AI产品的核心,Agent只是容器

文章澄清了AI产品开发中的关键认知偏差:Skill而非Agent才是核心。Skill定义了Agent如何执行任务、达到什么标准,是标准化的任务执行模块;Agent仅作为Skill的运行容器。Skill设计成为AI产品经理的核心工作,需将业务任务拆解成清晰执行规范。理解Skill与Agent的正确关系,是打造高质量AI产品的关键,也是AI产品经理进阶的必经之路。

2026-03-19 19:15:00 1065

原创 【值得收藏】深入理解LangChain多智能体:5种架构模式与搜索智能体实战

文章介绍了多智能体系统(MAS)的概念及LangChain中的五种实现模式:Subagents、Handoffs、Skills、Router和Custom workflow。通过构建搜索智能体的实际案例,展示了基于LangGraph的工作流和基于多智能体工具调用的两种实现方式。多智能体系统的核心价值在于通过群体智能突破单智能体能力边界,适配复杂、动态、大规模的任务场景,实现"1+1>2"的协同价值。

2026-03-19 19:13:50 352

原创 收藏!一文搞懂Langchain:大模型应用开发的终极指南

文章介绍了Langchain这一大模型应用开发框架,详细解析其核心组件(agent、tools、memory、model等)的功能与使用方法。提供了完整的环境准备、安装配置和快速入门教程,通过实例展示如何创建和调用agent。该框架整合各大模型厂商接口,提供统一API,简化了大模型应用开发流程,特别适合希望快速构建智能助手的开发者学习使用。

2026-03-19 19:12:43 441

原创 Agent技术实战指南:解决ToB场景落地难题,让你的AI应用产生实际商业价值(收藏必学)

本文分析了Agent技术在ToB场景落地的挑战,指出ReAct框架的局限性及业务需求复杂性。作者提出优化方案:采用快慢思考模型结合、定义三类工具(函数类、交互类、Agent类)、设计多Agent协作机制和完善异常处理策略。强调Agent技术虽处孵化阶段,但通过技术优化可提升其在企业场景的商业价值。

2026-03-19 19:12:01 477

原创 解决Agent不稳定问题:Agent Skills技能详解,建议收藏学习

Agent Skills是教AI Agent"怎么做事"的标准化技能说明书,解决了Prompt难以复用和Tool不负责流程的问题。它提供明确的执行流程和输出标准,通过SKILL.md文件定义技能,采用渐进式加载机制节省Token。Agent Skills与MCP互补,前者解决"怎么用能力",后者解决"能用什么能力"。开发者可从最小Skill开始,将常用Prompt升级为真正的Agent Skill,让AI Agent更像专业员工。

2026-03-19 19:11:04 585

原创 大模型RAG实战:从Demo到生产的5个级别,收藏级技术指南

文章介绍了将RAG系统从Demo升级到生产级的5个关键级别:智能分块解决文档切割问题,混合搜索结合语义和关键词检索,重排序提高结果相关性,添加护栏机制确保系统不编造答案。强调构建生产级RAG系统需循序渐进,从基础版本开始,根据用户反馈逐步改进,并通过测试用例持续评估系统性能。

2026-03-19 19:09:59 416

原创 为什么你的RAG系统效果不佳?11个组合策略助你提升准确率至94%【收藏必学】

本文分析了朴素RAG系统准确率低的问题,详细介绍了11种提高RAG系统准确率的策略,包括上下文感知分块、重排序、查询扩展等。作者通过组合这些策略,将系统准确率从60%提升至94%。文章提供了三种不同场景下的最佳组合方案和实施路线图,帮助开发者构建生产就绪的RAG系统,避免常见错误,实现从基础到专业化的渐进式改进。

2026-03-14 12:53:21 83

原创 收藏这篇就够了!一文详解MCP、RAG、Agent三大AI核心概念,小白秒变达人

本文解析AI三大核心技术:MCP作为"万能转换器"统一工具接口标准;RAG通过知识库检索解决AI"幻觉"问题;Agent作为智能体能主动理解任务并调用工具。三者形成"黄金三角",使AI进化为真正的"智能助手",大幅提升AI能力,为未来生活带来无限可能。

2026-03-14 12:52:19 160

原创 收藏必备!LangGraph工作流模式深度解析:从五种架构到子图设计,小白也能构建稳定AI系统

文章介绍了构建AI系统的Workflow模式,详解五种架构蓝图:提示词链式调用、并行化、路由、编排者-工作者和评估者-优化者模式。通过生成笑话示例展示了评估者-优化者模式的实现。文章还介绍了子图机制用于模块化复杂系统,支持状态隔离、团队协作和分形设计,提供了父图与子图的两种集成方式。掌握LangGraph可构建既具创造力又安全可控的智能体。

2026-03-14 12:50:31 393

原创 从零开始理解大模型核心架构:Function Call、Tool、MCP到Agent Skills的完整指南(建议收藏)

大模型应用的核心能力是内容生成和函数调用。文章解析了Agent、Skills、Tool和MCP的层次关系:Function Call是最底层能力;Tool是对Function Call的封装;MCP是统一工具调用协议;Skills是对Tool的进一步封装,便于非技术人员使用。Skills本质是代码模块化扩展,解决重复利用问题,提高大模型应用效率。

2026-03-14 12:26:59 239

原创 小白/程序员必看:AI Agent的7种形态完全解析,帮你轻松判断产品能力边界

本文系统解析了AI Agent的7种形态:对话式、检索增强、工具调用、工作流、多Agent协作、自主规划和端侧Agent。详细阐述了每种Agent的内部运作机制、适用场景和局限性,并提供了基于任务复杂度、自主性需求和隐私约束的选型三步法。文章强调,做AI产品选Agent形态应遵循"自主性够用就好,不要过度设计"的原则,大多数产品实际会混合使用多种Agent形态。

2026-03-14 12:25:31 392

原创 深入解析大语言模型智能体:核心架构与多智能体协作框架,值得收藏的深度指南

本文系统介绍了基于大语言模型(LLM)的智能体与传统AI智能体的本质区别,阐述了LLM智能体以语言为通用接口实现通用助手的能力。文章详细解析了七大核心组件:感知系统、大语言模型、规划系统、记忆系统、工具集成、行动执行和环境交互,并对比了AutoGen和CrewAI两种多智能体协作框架的设计范式,指出LLM智能体代表了AI发展的重要方向。

2026-03-14 12:09:38 394

原创 AgenticRAGTracer:首个LLM自动构建的Agentic RAG多跳推理诊断工具,小白也能轻松学习大模型评估方法

AgenticRAGTracer是首个由LLM自动构建的Agentic RAG基准测试工具,通过跳级感知诊断将推理过程拆解为多个可验证的步骤,精准定位失败节点。研究发现现有Agent存在"推理链扭曲"问题,无法合理分配推理步骤。该工具提供精细化调试能力,帮助研究者理解模型为何失败、在哪一步失败,推动Agentic RAG从"能用"走向"可靠"。

2026-03-14 12:05:31 313

原创 一文读懂AI智能体(Agent):小白也能掌握的大模型应用新方向

AI智能体(Agent)是能够自主思考规划、调用工具完成目标任务的大模型应用。与传统聊天机器人不同,它强调AI的自主性,从能力层面可分为AI完成不同比例任务的模式,结构层面通常包括"大脑"(大语言模型)、"感知记忆"和"行动工具"三大核心组件。当前市场上产品如豆包、扣子等更偏向智能体创建平台,而真正具有高度自主性的智能体仍在发展中。理解智能体概念有助于我们更好地创建和应用AI工具,提升工作和生活效率。

2026-03-14 12:02:03 404

原创 智能体记忆详解:解锁大模型长时推理与持续学习能力

智能体记忆是AI大模型实现持续学习与长时推理的核心能力。文章从形式层面(词元级、参数记忆、潜在记忆)、功能层面(事实记忆、经验记忆、工作记忆)和动态层面(形成、演化、检索)系统解析了智能体记忆体系。这些记忆机制协同工作,使静态大模型转变为能够与环境交互、持续适应的自适应智能体,是实现AGI的关键技术基础。

2026-03-14 11:54:19 426

原创 收藏!彻底解决RAG系统效果不佳问题:这套组合策略让准确率飙升60%

文章分析了朴素RAG系统效果不佳的原因,介绍了11种提升性能的先进策略,包括上下文感知分块、重排序、查询扩展等。通过组合这些策略,作者将系统准确率从60%提升到94%。文章提供了三种有效组合方案:生产就绪堆栈、高准确率堆栈和领域专家堆栈,并给出实施路线图和实际应用案例,帮助开发者构建高效可靠的RAG系统。

2026-03-14 11:52:56 401

原创 告别传统RAG!使用Agent Skills构建智能知识库,小白也能轻松掌握【必藏】

本文介绍了Agent Skills在知识库检索中的应用,通过渐进式加载策略实现智能检索。相比传统RAG,它能避免预建向量库,实现更精准的本地知识检索,支持多文件格式和复杂查询。文章详细展示了实现方法、设计原则和优化技巧,帮助读者将现有文档库转化为智能知识检索系统,提供了一种轻量高效的Agentic RAG解决方案。

2026-03-09 20:58:57 494

原创 AI Agent:2026年AI生态核心概念完全指南

文章介绍AI Agent作为2026年AI生态核心概念,包含感知、规划、行动、记忆和反思五大组件。详细解析了A2A协议使不同Agent协作,MCP协议标准化工具调用,以及Agent Skills模块化能力。这些技术构成现代AI Agent基础架构,使其能处理复杂任务、自我反思和协作,大幅降低开发门槛并提升效率。

2026-03-09 20:57:51 554

原创 为什么你的智能体总是“左支右绌“?【珍藏指南】多智能体架构解决方案

文章指出,企业智能体应用中常见的"单体巨无霸"设计存在复杂性失控、专业度稀释和维护困难三大问题。作者提出多智能体微服务架构作为解决方案,将智能体系统设计成类似"团队"的协作模式,通过专业分工、中央调度器和标准化通信协议实现高效协作。这种架构能分解复杂度、促进专业深耕、提升可维护性并实现资产化沉淀,使智能体从"演示工具"真正转变为"生产力系统"。

2026-03-09 20:55:38 389

原创 【必学收藏】AI Agent系统架构详解:从感知到优化的六大核心模块,构建智能闭环

文章详细介绍了AI Agent系统的六大核心模块:感知模块(信息获取与处理)、决策规划模块(基于大模型的思考)、执行模块(工具调用)、专业大模型模块、记忆管理系统(分层存储)和反馈优化模块(自我完善)。通过金融数据分析智能体的案例分析,展示了这些模块如何协同工作形成智能闭环,并探讨了未来AI Agent架构的模块化、边缘智能融合、多Agent协作等发展趋势。

2026-03-09 20:54:42 417

原创 向量数据库与大模型:AI技术人员的必备知识,建议永久收藏

文章介绍了非结构化数据处理的挑战,以及Embedding、向量和向量数据库的核心概念与应用。Embedding是将非结构化数据转换为向量的过程,向量是AI理解世界的数据形式。向量数据库专门用于存储和查询向量数据,具有相似性搜索和性能提升的优势,广泛应用于NLP大模型增强、图像识别、视频处理等AI场景,是AI时代的核心技术。

2026-03-09 20:53:21 333

原创 AI Agent核心技术与实践:2026年AI开发新趋势,收藏学习必备

文章介绍了AI Agent作为2026年AI生态核心概念,它具备自主决策、规划和执行能力,能处理复杂任务。详细阐述了Agent的五大核心组件(感知、规划/推理、行动、记忆、反思/评估),以及A2A协作协议、MCP标准化工具调用和Agent Skills模块化能力。这些技术共同构成了现代AI Agent的基础架构,使其能够像人类员工一样工作,并在2026年大幅降低了开发门槛,提高了安全性和可控性。

2026-03-03 19:16:09 562

原创 【收藏必备】Skills vs Agent全解析:程序员如何用Skills解放双手,提升开发效率

Skills是封装特定技术任务的标准化可复用模块,与Agent形成"任务执行单元"与"任务调度者"的互补关系。其核心价值在于解决重复开发、流程不规范、Prompt调试繁琐三大痛点。文章介绍了Skills在代码评审、运维部署、数据库管理和AI开发四大应用场景,并提供了先复用再定制、聚焦单一痛点、适配团队技术栈、结合CI/CD等最佳实践,帮助技术从业者提升效率,减少重复工作。

2026-03-03 19:15:20 592 1

原创 收藏必备!大模型辅助开发的极简实践:文档驱动,自然演进

文章讲述了团队从设计复杂AI辅助开发架构到简化为文本驱动的过程转变。核心观点是:LLM本身就是最好的解释器,不需要复杂架构;AI工程化应采用"文档即记忆"原则,通过AGENTS.md文件作为人机共用的入职手册;实践应遵循"先跑起来,自然演进"的理念,让需求驱动演进而非预设架构;通过单仓库模式实现团队知识共享,形成"复合工程",让每次实践产生复利,最终让AI成为团队的新成员。

2026-03-03 19:14:14 394

原创 大模型记忆工程完全指南:从架构设计到产业落地

本文系统剖析大模型记忆工程的核心技术,包括记忆分层管理(参数化、激活、明文记忆)、多粒度调度与记忆脑图组织。MemOS框架通过分层建模与智能调度解决大模型短时遗忘、知识碎片化等问题,显著提升个性化与推理能力。作者团队已开源MemOS框架并建立OpenMem社区,为金融、工业等场景提供"有记忆的AI"解决方案,助力大模型从参数堆砌向记忆增强演进。

2026-02-26 13:15:37 714

原创 【收藏必学】Agent元年实战:从技术框架到企业落地的完整指南

本文分析了Agent技术在企业落地面临的挑战,详细介绍了ReAct和Plan-and-Execute两种主流框架及其局限性。作者提出基于ReAct框架的优化方案,包括快慢思考模型结合、"泛化"工具定义、Multi-Agent协作机制和异常处理策略,解决了Agent在复杂业务场景中的稳定性问题。同时探讨了多意图处理和意图跳转等关键技术难题,为Agent技术从概念走向实际应用提供了实践参考。

2026-02-26 13:13:58 387

原创 【必学收藏】大模型实战:Transformer+LSTM时间序列预测完整代码实现

文章详细介绍了Transformer与LSTM融合模型在时间序列预测中的应用。Transformer通过自注意力机制捕捉长距离依赖,LSTM处理局部时序特征,二者结合实现全局与局部互补。文章提供了完整的Python代码实现,包括数据生成、模型构建、训练过程和结果可视化,通过损失曲线、预测对比图等展示模型性能。这种融合方法为时间序列预测提供了有效解决方案,适合小白学习和收藏参考。

2026-02-26 13:12:43 618

原创 【收藏】深入浅出Transformer:大模型入门必学核心算法

Transformer是基于自注意力机制的深度学习模型,采用Encoder-Decoder架构。核心技术包括自注意力机制、多头注意力、位置编码等,通过残差连接和层归一化稳定训练。相比RNN,Transformer能高度并行计算,有效捕捉长距离依赖,具备强大的特征提取能力。作为BERT、GPT等大模型的基础架构,Transformer已成为现代AI领域的核心技术,展现出强大的"涌现"能力和可扩展性。

2026-02-24 18:42:14 592

原创 【干货收藏】深入浅出ReAct Agent:让AI边思考边行动的智能体开发实践

本文深入解析了ReAct Agent的核心原理与工程价值,详细阐述了"观察-思考-行动"的工作模式。通过对比传统编程,展示了ReAct Agent在处理复杂任务时的灵活性与优势。文章介绍了历史上下文、环境信息、LLM推理、工具调用等关键要素,并通过实例与伪代码清晰展示了实现方法,帮助开发者快速掌握从"写流程"到"造智能体"的关键跃迁。

2026-02-24 18:41:26 381

原创 大模型智能体开发必备:Agent Skills框架全解析,收藏级学习资源

文章系统介绍了支持Agent Skills开发范式的主流智能体框架,重点解析动态工具加载与渐进式披露能力。详细对比了LangChain、LangGraph、AutoGen、CrewAI、Claude Agent SDK和LlamaIndex等框架的核心特点与适用场景,提供选型建议和技能开发最佳实践。这一范式通过智能推理时动态加载必要技能,而非一次性加载全部能力,有效解决工具过多导致的"降智"问题,是构建高性能智能体的关键技术方向。

2026-02-24 18:40:34 846

原创 收藏这篇就够了!AI Agent、Skills、MCP和A2A:构建智能体系统的四大支柱

本文深入解析AI领域的四大关键概念:Agent作为自主决策与执行的"大脑";Skills作为原子化能力封装模块;MCP作为连接外部世界的标准化接口;A2A作为支持Agent间协作的协议。这四者构建了从原子能力到多智能体协同的完整技术栈,通过分层架构实现能力封装、可信调用、自主决策与协同编排,为AI系统的规模化落地提供坚实支撑,共同推动Agent生态系统向更开放、高效的方向发展。

2026-02-23 20:27:51 970

原创 【2026必看】构建智能Agent:从架构设计到A2A协作与MCP协议的完整指南

本文详解AI Agent生态系统核心概念,包括具备感知、规划、行动、记忆和反思能力的闭环架构,Google主导的A2A协作协议实现Agent间任务分工,Anthropic的MCP标准化协议统一工具调用接口,以及将能力模块化的Agent Skills概念。这些技术共同构成2026年AI Agent开发基础,大幅降低开发门槛,提升安全性和可控性,是开发者必学收藏的实用指南。

2026-02-23 20:26:47 739

原创 收藏必备:一文掌握LangChain多智能体系统架构与应用实战

文章介绍了多智能体系统(MAS)的基本概念和LangChain中的五种实现模式(Subagents、Handoffs、Skills、Router、Custom workflow),并通过搜索智能体案例展示了基于LangGraph的工作流和基于LangChain的双智能体系统实现。多智能体系统通过群体智能突破单智能体能力边界,适合处理复杂、动态、大规模任务场景。

2026-02-23 20:25:31 597

原创 AI时代就业变革:四大效应与五大新型职业,未来职业增长三大方向解析!

AI对就业影响呈现增强、替代、补充和创造四大效应,当前替代效应快于创造效应,但通过劳动力再培训可缓解失业风险。AI催生五类新职业:使能者(技术研发)、协作者(人机协作)、治理者(伦理安全)、推广者(市场应用)和支持者(运营保障)。这些职业呈现深度细分、跨界融合、人机协作和动态流变特征。未来职业增长将集中在AI原生、服务业和灵活就业领域,建议个人主动学习AI技能,企业以人为本转型,社会构建就业友好环境,共同应对AI带来的就业变革。

2026-02-19 12:39:43 641

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除