【LLM大模型】
文章平均质量分 95
在当今人工智能技术飞速发展的时代,大模型应用开发已成为众多企业和开发者关注的焦点。本系列将围绕大模型应用开发的基础知识和实战技巧进行深入探讨,帮助开发者更好地掌握这一领域的核心技能
小小工匠
show me the code ,change the world
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
Agent Harness 十二大模块完全解析:为什么生产级智能体的胜负手不在模型,而在“脚手架”
文章摘要: Agent Harness(智能体运行框架)是决定AI智能体实际表现的关键基础设施,它将“裸”大语言模型转化为可靠的任务执行系统。实验表明,仅优化外围框架(不改变模型本身)即可大幅提升智能体性能。Harness包含十二大核心模块,如编排循环(任务调度引擎)、工具层(现实交互接口)、记忆系统(跨会话连续性)和上下文管理(防止信息过载)。这些模块协同工作,解决了生产环境中常见的性能断崖问题。类比计算机架构,Harness如同操作系统,使模型的推理能力转化为稳定落地的行动。未来AI工程竞争的核心战场正原创 2026-07-08 23:04:45 · 466 阅读 · 0 评论 -
拒绝玄学编程:用上下文工程让 AI 啃下复杂代码库
文章摘要:本文探讨了AI编程工具在实际生产环境中的局限性,尤其是在处理复杂代码库时的低效问题。通过HumanLayer创始人Dex Horthy的经验分享,提出了“上下文工程”方法论,强调优化上下文窗口管理是提升AI编程效率的关键。文章详细介绍了主动压缩、子代理和RPI工作流(研究、规划、实现)等实用技巧,帮助开发者在大型代码库中高效利用AI工具,避免“返工陷阱”。通过实战案例(如30万行Rust代码的bug修复)验证了这套方法的有效性,展示了如何让AI在真实开发场景中发挥更大价值。原创 2026-06-26 05:15:00 · 543 阅读 · 0 评论 -
推理的本质:重新理解大语言模型的「思考」——Denny Zhou 斯坦福 CS25 讲座精读
大模型推理能力的本质在于生成中间步骤(中间token),而非模仿人类思考。DeepMind团队通过数学证明,允许生成足够长的中间序列,固定大小的Transformer理论上可解决任意复杂问题。研究发现,预训练模型已具备推理能力,但需改进解码策略(如思维链解码)使其显现。提示工程(如思维链提示)虽能激发推理,但依赖人工设计。监督微调(SFT)泛化能力有限,而强化学习微调通过模型自生成解答优化推理能力,更接近"直接优化目标"的机器学习原则。这些研究为大模型的推理能力提供了理论基础和实践路径。原创 2026-06-25 06:45:00 · 528 阅读 · 0 评论 -
Claude Code 完全实战指南:从安装到生产部署的工程化全景
摘要:用Claude Code重构AI协作工作流 本文系统介绍了如何将Claude Code从"对话工具"升级为"生产力引擎"。核心要点包括:1) 通过终端安装实现本地化部署,使AI可直接操作系统文件;2) 在VS Code或Antigravity IDE中配置智能体权限模式,平衡安全与效率;3) 利用CLAUDE.md文件作为项目"大脑",通过预设技术规范持续指导AI输出;4) 演示十分钟构建完整网站的实例,展示AI在代码重构和任务拆解方面的能力。文章强调,这种工作流重构的关键在于建立清晰的协作规则,而非原创 2026-06-24 06:30:00 · 698 阅读 · 0 评论 -
拆解大语言模型:从词向量到注意力机制的内部运行原理
摘要: 本文深入浅出地解析了大语言模型(如ChatGPT)的工作原理,围绕词向量、Transformer架构与训练机制展开。词向量将单词编码为高维数字,通过向量运算捕捉语义关系(如“国王-男+女≈女王”)。Transformer模型由多层网络构成,每层通过注意力机制动态关联上下文(如解决代词指代),前馈网络则基于上下文预测下一个词。训练过程通过反向传播调整海量参数,使模型从数据中自主学习语言规律。尽管模型内部机制复杂且难以完全解释,研究者已通过实验揭示了部分运作逻辑,例如注意力头协作解决语义歧义。大模型的“原创 2026-06-15 19:48:27 · 542 阅读 · 0 评论 -
Agent 不止于 Chat:垂直 AI 时代的协作界面重构
摘要:AI Agent在复杂任务中的瓶颈与突破方向 当前AI Agent在执行长程复杂任务时面临核心矛盾:用低带宽的聊天界面驱动高度并行的工作树,导致人类判断只能在根节点介入。文章基于Legora CTO的演讲,提出三个关键观点: 生产瓶颈转移:AI已能完成标准化任务,真正的瓶颈在于任务规划与结果审阅。垂直AI需要优化意图输入和结果验证的交互方式。 验证性原则:任务能否被AI接管取决于可验证性。应将行业任务按"易解性/易验证性"二维分类,优先攻克高验证性任务,通过任务改造和代理验证提升可靠性。 信任与控制矩原创 2026-05-24 10:45:50 · 816 阅读 · 3 评论 -
从 LLM 到 Agentic Workflow:一份 AI Builder 的完整技术地图
摘要 本文系统梳理了Stanford「Beyond LLM」课程的核心内容,为AI工程师提供了一套完整的LLM增强技术路线图。文章首先指出Base Model的四大短板:缺乏领域知识、信息滞后、输出不可控和长上下文表现退化。针对这些问题,详细介绍了三种关键技术:Prompt Engineering(强调结构化思维和Prompt Chaining)、Fine-Tuning(建议谨慎使用)和RAG(检索增强生成的标准解法)。文章特别指出,RAG通过向量检索和文档分块技术,有效解决了知识更新和幻觉问题,在当前技术原创 2026-05-22 06:45:00 · 584 阅读 · 0 评论 -
LLM - awesome-design-md 从 DESIGN.md 到“可对话的设计系统”:用纯文本驱动 AI 生成一致 UI 的新范式
本文介绍了一种创新的设计系统表达方式——DESIGN.md,这是一种用纯Markdown编写的结构化文档,旨在让AI模型能够准确理解和遵循设计规范。文章分析了传统设计系统载体对AI不友好的问题,阐述了DESIGN.md的核心优势,并详细介绍了awesome-design-md开源仓库的架构与内容。该仓库收录了众多知名产品的设计系统Markdown模板,包含9大标准化章节,从视觉主题到组件样式全面覆盖,为"AI+UI生成"提供了可落地的工程化解决方案。通过这种文本化的设计规范,开发者可以更原创 2026-04-09 22:44:44 · 3867 阅读 · 0 评论 -
LLM - 2026 AI 文本转可视化工具终极指南:PicDoc.ai vs Napkin.ai 及 EdrawMax、Whimsical 等 8 大神器深度对比
2026年AI生产力工具迎来爆发,PicDoc.ai和Napkin.ai作为文本转图表的代表产品各具特色。PicDoc.ai擅长专业图表生成,支持中文和多格式输入;Napkin.ai则侧重轻量协作和快速可视化。此外,EdrawMax AI(中文友好)、Whimsical AI(极简脑暴)、Gamma.app(演示文稿)、Venngage AI(高颜值信息图)、Miro AI(团队协作)和Lucidchart AI(技术图表)等工具也各有所长。用户可根据中文支持、协作需求、专业程度等维度选择,建议组合使用不同原创 2026-04-03 20:39:13 · 1556 阅读 · 0 评论 -
用 Nano Banana Pro 一小时做完高质量 PPT:从提示词到完整工作流实战
本文介绍了一种利用AI工具高效制作PPT的两阶段工作流:先用大语言模型(如ChatGPT)生成结构化大纲与内容,再通过图像模型(如Nano Banana Pro)逐页生成视觉化PPT单页图。该方法将传统PPT制作中的认知成本与设计成本分离,用户只需提供需求文档和参考模板,AI即可自动完成95%的工作。关键步骤包括:让AI扮演专业PPT设计师生成详细大纲,基于风格参考图生成4K分辨率单页图,最后将图片直接插入PPT工具。文章还提供了具体的提示词模板、效果展示及工程化建议,特别适合技术汇报、方案演示等标准化场景原创 2026-03-28 16:08:13 · 1663 阅读 · 0 评论 -
LLM - 一文读懂Agent Harness
摘要: 2026年,大模型的核心竞争力从“智商”转向长流程任务的耐久性与可靠性,而Agent Harness成为支撑这一能力的关键基础设施。与传统Agent框架不同,Harness如同“操作系统”,系统化解决长流程中的三大难题:上下文管理(压缩与卸载)、任务协作(并行拆分与编排)和实时纠偏(监控与回滚)。实践表明,Claude Code等案例通过系统级工程显著提升稳定性。设计Harness需遵循轻量化与模块化原则,避免过度工程化,从最小原型(如原子工具+基础监控)逐步演进,聚焦可删除的灵活架构。最终,Har原创 2026-03-03 06:00:00 · 4642 阅读 · 0 评论 -
LLM - 生产级 AI Agent 设计手册:从感知、记忆到决策执行的全链路架构解析
本文提出构建生产级智能体AI系统的7层架构方法论,旨在解决企业应用中可控性、可观测性和可演进性的核心需求。该框架包括:目标与价值对齐层(明确业务目标与约束)、感知与数据接入层(统一多源数据输入)、记忆与知识管理层(管理长期知识与短期记忆)、规划与决策层(任务分解与策略选择)、行动执行层(工具调用与系统集成)、反馈与优化层(数据采集与持续改进)以及安全与监控层(风险控制与合规审计)。文章强调企业级智能体需平衡自主性与治理要求,通过分层解耦实现从概念验证到生产部署的跨越,并提供了各层级的具体实践建议,如目标分层原创 2026-03-01 21:08:59 · 1539 阅读 · 0 评论 -
LLM - 多智能体(Multi-Agent)系统:从控制理论到大模型时代的工程演进与未来范式
随着大语言模型(LLM)的发展,多智能体系统(Multi-Agent System)重新成为技术焦点。本文探讨了单智能体(Single Agent)与多智能体(Multi-Agent)的工程路径差异,指出单智能体短期更易落地,但多智能体在复杂任务协作中具有长期优势。真正的挑战在于系统工程,而非模型能力,包括通信机制、协同决策和全局调度。未来突破方向将聚焦记忆工程、环境工程和持续学习,推动AI从个体智能迈向群体智能,最终形成类似操作系统的多智能体协作网络。这一转型标志着AI从模型工程向系统工程的跨越。原创 2026-02-25 06:45:00 · 2846 阅读 · 0 评论 -
LLM - Claude Code × OpenClaw:构建“左脑工程 + 右脑代理”的下一代 AI 开发工作流
AI助手正分化为工程型(如Claude Code)和个人代理型(如OpenClaw)两类。前者专注代码生产,后者管理跨平台任务。两者的协同将重构开发流程:工程AI负责技术执行,个人AI处理信息流和自动化。未来开发者需掌握AI调度能力,从代码编写者转变为AI协作系统的设计者。这种分工模式标志着AI从工具向协作伙伴的进化,推动开发范式向"人类决策+AI执行"转变,带来生产力的层级跃升。技术人员的核心技能将转向系统设计和AI工作流管理。原创 2026-02-25 05:15:00 · 3222 阅读 · 0 评论 -
LLM - awesome-openclaw-usecases 用 OpenClaw 把生活“外挂化”:从技能到真实场景的系统指南
> 面向读者:已经了解 / 正在尝试 OpenClaw、各种 Agent、自动化工作流的开发者、研究者和技术爱好者,希望从「能做什么」到「怎么落地」建立系统认知。原创 2026-02-24 05:45:00 · 6062 阅读 · 0 评论 -
LLM -Awesome OpenClaw Skills:给本地 AI 助手装一个「超级插件市场」
OpenClaw技能生态指南:精选3000+本地AI助手扩展能力 OpenClaw是一个可在本地运行的AI助手,通过安装"技能"(Skills)扩展功能。官方技能库ClawHub包含5700+社区技能,但存在质量参差不齐的问题。awesome-openclaw-skills仓库精选3002个通过可用性筛选的技能,覆盖20多个场景,包括: 编码协作(133个) Git管理(66个) 前端开发(202个) DevOps(212个) AI模型管理(287个)等 安装方式支持: 官方CLI工具一原创 2026-02-19 06:30:00 · 7839 阅读 · 2 评论 -
LLM - 10分钟安装 OpenClaw:把 AI 管家跑在你自己的电脑上
OpenClaw 是一个"自托管"的 AI 管家系统:本地/服务器起一个 Gateway,接入飞书/Telegram 等聊天渠道,支持插件、工具调用、定时任务和仪表盘。适合把 AI 变成"能干活"的助手,而不仅是聊天。原创 2026-02-18 20:03:20 · 7833 阅读 · 0 评论 -
LLM - Google NotebookLM Skill 介绍与实战
文章摘要: NotebookLM-py 是一个非官方的 Python SDK 和 CLI 工具,通过逆向工程 Google NotebookLM 的内部接口,为开发者提供了编程调用 NotebookLM 的能力。该工具支持创建和管理 Notebook、导入多种数据源(URL、PDF、音视频等)、对话交互、研究功能自动化,以及生成音频、视频、幻灯片等多种内容格式。其核心优势在于将网页端的操作完全 API 化,并扩展了批量导出、权限管理等额外功能,适合自动化内容生成、学习系统构建等场景。但由于依赖未公开接口,存原创 2026-02-09 11:19:57 · 4745 阅读 · 0 评论 -
LLM - 从 0 打造专业 Agent Skill:一套能落地的完整实践指南
本文探讨了如何通过「Agent Skill」将零散的Prompt和经验转化为可复用的专业技能模块,解决传统用法中的重复劳动、易遗漏和难维护问题。Skill是一个可复用的知识包,让AI自动触发专业能力,相比其他方案更注重专业技能与业务流程。设计Skill需遵循四个原则:渐进式披露信息、优化上下文资源、按任务脆弱性调节自由度、针对模型编写操作手册。文章还介绍了五种Skill结构模式(极简指导型、示例模板型、工具脚本型、知识库型和混合型),帮助用户根据需求选择合适的设计方案。原创 2026-02-07 17:09:08 · 2306 阅读 · 0 评论 -
LLM - 从 Prompt 到 Skills
2025年,Claude Skills/AI技能模块成为技术新焦点,标志着AI从聊天工具向任务执行者的转变。与一次性指令Prompt不同,Skills是可复用、自动触发的AI能力单元,包含明确的能力边界、输入输出规范和触发策略。其爆火源于AI决策能力提升、Agent架构成熟及生态形成,使AI能真正替代人类完成任务。 当前实用Skills资源包括:Anthropic官方文档处理工具、社区精选导航站(如Awesome Claude Skills)、工程化工作流市场(Claude Skills Market原创 2026-01-11 22:34:08 · 4212 阅读 · 0 评论 -
LLM - 跑大模型到底要多大显存?一文讲透从原理到实战
摘要: 大模型时代,显存成为能否运行模型的首要门槛。本文系统分析显存消耗的四大来源:模型参数、中间激活、KV Cache和框架开销,并针对推理、微调、训练场景给出显存估算方法。例如,7B模型FP16推理约需18GB显存,轻量微调需24GB,而全参数训练显存需求呈数量级增长。选型建议:本地玩家可选8-24GB显卡运行7B/13B量化模型,团队服务需24-48GB显存支持长上下文与并发。合理估算显存需求是硬件规划的关键。原创 2026-01-11 22:22:22 · 2582 阅读 · 0 评论 -
LLM - 从定制化 Agent 到 Universal Agent + Skills Library:下一代智能体架构实践
摘要: 大模型应用中的Agent架构正从「专用Agent堆叠」转向「通用Agent+技能库」范式。传统方案因上下文臃肿、维护成本高、知识无法复用而难以扩展。新架构以Universal Agent作为决策中枢,配合模块化Skills Library,实现能力的按需加载与组合。每个Skill包含元数据、详细指令和可执行资源,通过渐进式加载平衡上下文限制。该架构支持组织级知识沉淀,使新增能力只需添加Skill而无需修改Agent核心,为规模化落地提供了可行路径。原创 2026-01-11 21:52:37 · 3015 阅读 · 0 评论 -
LLM - Claude Code Skills 实战指南:用模块化“技能包”重构AI 开发工作流
摘要:AI工程化新范式——Claude Code Skills机制解析 本文系统阐述了Claude Code推出的Skills机制,这是AI工程化领域的重要创新。随着大模型能力提升,团队差异已从"模型智能度"转向"AI工作流集成能力"。Skills机制通过将AI能力拆解为可组合、可复用的"技能包",解决了传统Prompt方法存在的上下文冗余、行为不可预测等问题。文章详细分析了Skills的三层架构(元数据、指令层、资源层)和自动激活机制,并与Hoo原创 2026-01-10 23:03:25 · 4949 阅读 · 0 评论 -
LLM - A2UI:Google 引领的生成式 UI 革命
A2UI(Agent-to-User Interface)是Google推出的开源项目,通过JSON格式传输"界面意图"而非可执行代码,解决了AI生成UI的安全性和兼容性问题。核心优势包括:1)安全优先设计,采用声明式JSON和预审批组件目录;2)支持流式增量渲染,提升用户体验;3)框架无关性,同一JSON可在不同平台渲染为原生UI。A2UI为生成式UI提供了安全、高效、跨平台的解决方案,已在Google多个生产系统中应用。原创 2026-01-10 22:49:38 · 3479 阅读 · 0 评论 -
LLM - 将业务 SOP 变成 AI 能力:用 Skill + MCP 驱动 Spring AI 应用落地不完全指南
在大模型时代,Agent已从简单聊天机器人发展为能处理复杂任务的数字员工。Anthropic提出的Model Context Protocol(MCP)和Agent Skills(Skill)是关键解决方案:MCP标准化外部工具连接,Skill封装可复用任务流程。文章系统分析了传统工具调用的痛点,对比了MCP与Skill的分层协作关系,并通过两个实战案例(自动周报生成和结合Spring AI的数据分析)展示了如何构建实用AI Agent。MCP解决"怎么连"的问题,Skill解决&原创 2026-01-08 23:15:35 · 4687 阅读 · 0 评论 -
LLM - 面向工程实践的Agent Skills设计方法论
摘要: 在Agent开发中,过度加载上下文会导致性能、质量和成本问题。Anthropic提出的三层技能结构(元数据层、正文层、附属文件层)通过渐进式加载实现高效上下文管理。建议从"工具视角"转向"工作流视角"组织技能,确保每个技能聚焦单一能力。实践案例显示,将SKILL.md控制在200行内可提升4.8倍token利用率,显著降低延迟和溢出风险。落地时需审计现有技能,重构边界,并制定"200行规则"和冷启动测试规范,以优化Agent的稳定性和成本效原创 2026-01-03 09:15:00 · 3596 阅读 · 0 评论 -
LLM - TOON 与“面向模型”的新一代数据格式
摘要:JSON在LLM时代的局限性及TOON格式的优化方案 传统API时代广泛使用的JSON格式,在大语言模型(LLM)应用场景中暴露出显著问题。核心矛盾在于:LLM按Token处理数据,而JSON的结构冗余导致大量无效Token消耗。典型问题包括重复字段名、结构符号占用上下文预算,降低了模型的有效信息获取率。 新兴的TOON(令牌优化对象表示法)通过三项关键改进重塑数据格式:扁平化嵌套对象、消除重复结构、采用表格化排列。实测显示TOON相比JSON可节省约60%的Token,显著提升上下文窗口的信息密度。原创 2026-01-03 07:45:00 · 1809 阅读 · 0 评论 -
LLM - Skills vs MCP:AI Agent 能力扩展的双螺旋
AI Agent技术栈中的Skills与MCP(Model Context Protocol)是两条关键能力路径:Skills负责固化方法论和流程(如代码审查、文案规范),通过结构化知识提升Agent的专业性;MCP则标准化外部系统连接(如GitHub、数据库),实现安全可控的工具调用。两者分别从内部心智和外部感知维度增强Agent能力,需协同使用——Skills确保执行质量,MCP扩展能力边界。这种组合使Agent从演示原型升级为可落地的生产系统。原创 2026-01-03 06:30:00 · 3312 阅读 · 0 评论 -
LLM - Claude Skills:从通才 AI 到可复用的领域专家
摘要:Claude Skills 是可复用的专家能力单元,包含指令、知识和工具,解决现有AI应用中的Prompt复用难、工作流固化等问题。通过渐进式披露机制,Skill仅在必要时加载相关信息,避免上下文污染。开发者可通过六步流程创建Skill,包括定义元数据、设计专家工作流等。相比Sub-Agents和MCP,Skills更轻量,适合垂直任务场景,能实现模型在不同专家模式间的灵活切换,提升AI应用的工程化水平。(149字)原创 2026-01-02 07:15:00 · 2999 阅读 · 0 评论 -
LLM - MCP 实战指南 : N×M → N+M 架构革命
摘要 Model Context Protocol(MCP)是一种开放标准协议,旨在解决大模型与外部工具、数据源集成困难的问题。MCP通过统一接口连接AI应用(如LLM、Agent)与各类服务,降低集成复杂度,促进开放生态。核心包括基于JSON-RPC的协议层、工具调用、资源访问和提示模板三大能力,支持多种传输方式。相比传统插件或手写集成,MCP将N×M的定制集成简化为N+M的标准协议,实现解耦复用。协议还包含安全控制和权限管理,适合企业环境。MCP有望成为AI时代的通用协议,推动从"手动挡&qu原创 2026-01-01 05:45:00 · 1845 阅读 · 0 评论 -
LLM - 从 MCP 到 Skills:2025 年 AI Agent 的工程实践全景解析
摘要: AI Agent技术正从概念走向落地,通用Agent虽功能全面但成功率低,垂直场景Agent(如Coding Agent)表现更优。MCP协议解决了Agent与工具/数据的连接问题,而Skills层通过可复用的“技能包”提升了任务执行的稳定性。上下文工程通过精准控制信息输入(写入、选择、压缩、隔离)优化决策质量。未来Agent将演变为以LLM为核心、工具为外设的云端计算环境,需结合工程化方法实现高效落地。原创 2025-12-31 11:26:29 · 3241 阅读 · 0 评论 -
LLM - 单Agent和多Agent 架构的需求思考和实现路径
AI系统正从单体智能转向多智能体协作架构。早期Copilot主要完成简单任务,而现代Agent系统已能深入业务流程,承担专业角色。单体智能架构简单但面临职责过载等问题,多智能体通过角色拆分实现模块化协作,但需解决通信与调试难题。关键设计包括记忆体系(短期/长期、共享/私有)和护栏系统(行为边界、安全过滤)。建议项目初期采用单体验证核心价值,逐步拆分为多智能体并关注产业协议标准。产品设计应从"角色列表"出发,将观测性作为首要考量,避免过早锁定架构方案。原创 2025-12-31 05:00:00 · 1884 阅读 · 0 评论 -
LLM - 生产级 AI Agent 设计手册:从感知、记忆到决策执行的全链路架构解析
本文提出构建生产级智能体AI系统的7层架构方法论,旨在解决企业场景下智能体系统可控、可观测、可演进的需求。7个核心层级包括:目标与价值对齐层(定义业务目标与约束)、感知与数据接入层(多源数据统一接入)、记忆与知识管理层(长期知识与短期记忆管理)、规划与决策层(任务分解与策略编排)、行动执行层(工具调用与系统集成)、反馈与优化层(多维度反馈采集与持续优化)、安全与监控层(风险控制与合规审计)。文章详细阐述了各层级的核心职责、关键问题及实践建议,强调通过分层解耦实现智能体从概念Demo到企业级系统的转变,并特别原创 2025-12-30 22:34:36 · 2101 阅读 · 0 评论 -
LLM - MCP Server 标准化工具交互全指南
摘要: Model Context Protocol (MCP) 是 AI Agent 工具交互的标准协议,由 Anthropic 于 2024 年推出,旨在解决 Agent 与外部资源集成的碎片化问题。MCP 通过标准化工具发现、调用和响应流程,提升扩展性与安全性,支持多种传输方式(如 HTTP、SSE)。其核心优势包括模块化、动态工具发现和语义描述(如 inputSchema)。落地实践中,MCP Server 需解决安全性(认证授权)、动态编排和存量服务转化等挑战,通过注册中心与网关实现工具生命周期管原创 2025-12-29 23:04:31 · 1930 阅读 · 0 评论 -
LLM - 行业 AI Agent 实战指南:系统化落地的四层架构与最佳实践
2025年被视为"AI Agent元年",垂直行业Agent面临的核心挑战是如何将行业专有知识(Know How)系统化。行业Know How包含术语体系、规则约束等五大模块,但80%的行业Agent失败源于知识未结构化。文章提出"知识-数据-行为-模型"四层架构解决方案:知识层通过结构化术语与规则库实现隐性知识显性化;数据层建立测试集先行机制;行为层定义Agent执行边界;模型层采用RAG优先策略。最后以Spring AI框架为例,展示了企业级Java Agent的原创 2025-12-29 21:50:21 · 2170 阅读 · 0 评论 -
LLM - 用 SpecKit 和 AICode 改造遗留系统 完整实践指南
摘要:SpecKit与AICode结合为存量Java Web系统提供规范驱动开发流程,通过五步标准化流程(对齐原则、需求规格化、技术设计、任务分解、自动实现)解决AI编码带来的风格分裂、测试缺失等问题。以Spring Boot项目为例,从定义项目宪法到代码实现,建立可复用、可协作的开发规范,提升团队协作效率与代码可维护性。原创 2025-12-24 22:47:16 · 2710 阅读 · 0 评论 -
LLM - 如何构建AI Agent_ 从工作流到Agentic模式的系统实践指南
AI智能体应用设计指南 随着大语言模型发展为能自主规划、调用工具的AI智能体,如何合理应用成为关键。本文提出实用建议: 适用性判断:固定流程用工作流更高效;复杂推理场景才需智能体。需权衡延迟与成本收益。 工作流三模式: 提示链:有序拆解任务 路由:智能分发子任务 并行化:同时处理独立任务 智能体四模式: 反思:自我审查迭代 工具使用:连接外部系统 规划:中央协调多步骤 多智能体:角色分工协作 实践建议:从简单版本开始,混合使用模式,注重日志监控和异常处理。先用工作流打基础,再在关键环节引入智能体,通过指标持原创 2025-12-24 22:34:10 · 1888 阅读 · 0 评论 -
LLM - 基于 Spring AI Alibaba Graph 重构多智能体订单助手:从单体 Agent 到图工作流的工程实践
本文介绍了如何利用Spring AI Alibaba Graph将多智能体订单助手重构为图工作流形态。传统基于if-else的编排方式存在维护困难、扩展性差等问题,而Graph方案通过StateGraph、Node、Edge和OverAllState四个核心概念,将复杂业务逻辑转化为清晰的可视化流程图。 文章详细说明了项目采用的多模块架构设计,包括ai-starter、ai-graph-order等模块的职责划分。重点阐述了订单助手Graph的设计思路,将业务拆分为入口节点、意图识别节点和多个Agent节点原创 2025-12-23 04:45:00 · 4187 阅读 · 0 评论 -
LLM - 从生成式到 Agentic (Java技术栈)
2025年成为AI Agent工程化与产业化的关键拐点,技术从生成式AI向Agentic AI演进,重点转向工具调用、记忆、规划与多智能体协作等系统能力。Spring AI等框架推动Java工程实践落地,典型应用场景覆盖金融、客服、工业等领域。智能体需具备四大核心能力:工具调用(驱动API/数据库)、记忆(维持长期交互)、规划(任务拆解与执行)、多智能体协作(角色分工)。产业应用已从试点转向可量化ROI阶段,但仍面临数据隐私、系统集成与风险治理等挑战。Spring AI多Agent Demo展示了订单助手场原创 2025-12-22 05:45:00 · 2671 阅读 · 0 评论 -
LLM - 从 RAG 到 Context Engine:2025 实战总结与 2026 落地指南
以“实战向”视角,聚焦三个问题: 1. 如何搭一个现代 RAG 系统,而不是“向量库 + Embedding”拼凑品。 2. 如何把 RAG 升级为支撑 Agent 的 Context Engine,接管知识库、Memory 和 Tool Retrieval。 3. 2026 年要不要上多模态 RAG,上了怎么活下来(成本与工程挑战)。原创 2025-12-22 05:00:00 · 2900 阅读 · 0 评论
分享