- 博客(403)
- 收藏
- 关注
原创 非常火的ai工程师路线图
文档加载(PDF/Markdown/Word)→文本分割→向量化→入库→检索召回→Prompt组装→LLM生成→结果溯源。✅ 深度学习算法工程师:补充CNN、Transformer细节、数据集构建、SFT微调、多模态、模型压缩、更多数学知识。✅ 大模型应用工程师(推荐):重点RAG/Agent、FastAPI、向量库、LangChain,弱化模型训练。企业文档问答系统:支持PDF上传、文档增量更新、引用来源、权限控制。Embedding模型、文本切片、向量检索、混合检索。
2026-10-06 16:21:05
204
原创 Java从小白进阶学习之Java架构师的学习路线
本文探讨如何成为Agent工程师,指出Agent开发是一种方向,而非所有程序员的必选道路。作者强调,应根据业务需求决定是否采用Agent技术,而非盲目跟风学习。文章分享实际案例,指出开发Agent时需关注业务场景,如安全控制、任务管理等,而非单纯的技术堆砌。同时,提出利用Coding Agent学习源码,但需结合业务需求验证方案有效性。最终,作者建议关注业务问题,而非纠结于技术标签。
2026-10-06 16:05:49
91
原创 从 LLM 到 Agent:一文彻底搞懂什么是 AI Agent
过去几年,大模型(LLM)彻底改变了我们与软件交互的方式。你问它问题,它给你答案;你让它写代码,它给你代码;你让它总结文章,它给你摘要。它很会说,但不会做。在没有工具接入的情况下,它不能直接帮你查今天的航班,不能帮你把代码提交到 Git,不能帮你打开浏览器填表单,不能根据中间结果自动调整策略。自己把问题拆成步骤;自己复制粘贴到不同工具;自己判断下一步做什么;自己把结果拼起来。你成了那个“人肉 Agent”。于是,AI Agent 出现了。它的目标不是让模型“更会聊天”,而是让模型。
2026-10-06 15:57:57
30
原创 Agent 的核心组件:大脑、记忆、手脚与心跳
很多人第一次接触 Agent,会以为:“Agent 就是一个更聪明的 LLM。但真正跑起来你会发现,LLM 只是其中一块。感知:接收输入和环境状态;LLM 与规划:推理、决策、任务分解;记忆:保存上下文、状态和经验;工具:与外部世界交互;行动:真正执行并改变环境;执行循环:把上面五步串起来,持续运转。LLM 是大脑;规划是调度器;记忆是经验与状态;工具是手脚;行动是执行;循环是心跳。
2026-10-06 15:49:51
177
原创 Agent 的架构、多智能体与落地:从 Demo 到生产系统
Agent 从 Demo 到生产,核心不是“让它更聪明”,而是“让它更可控”。确定性骨架 + 概率性智能:状态机控制流程,LLM 负责节点内部的不确定问题。不要把所有决策权交给模型。可观测是底线:每一步都要有日志、有轨迹、能回放。没有可观测性,就无法调试,就无法迭代。评估驱动迭代:先定义成功,再定义指标。轨迹比结果更重要,静默失败是最大的陷阱。人机协同是常态:高风险动作必须人工确认。人工审核应该是正式的流程节点,而不是临时嵌入的检查。能单不多,混合优于单选。
2026-10-06 15:29:05
17
原创 从Java后端到AI Agent开发,我的学习路径分享
我们带学的时候,第一个阶段并没有让他疯狂背Agent八股,而是先让他真正理解Agent和传统软件开发到底有什么区别。面试官可能会问你什么是Agent,但真正往下追问的时候,往往不是让你背一个定义,而是会问:“你这个项目为什么要用Agent?”这其实比背定义重要得多。因为不是所有业务都需要Agent,如果一个流程完全可以通过固定规则和普通代码解决,就没有必要为了AI而AI。
2026-09-30 15:18:11
223
原创 探索 Agent 的本质:如何塑造智能体的决策力
LLM 是"硬件核心",Agent 是"操作系统"。这样,“查三笔违约金"不再是一个模型猜着回答的问题,而是:模型先调用"查询违约交易"工具 → 工具返回数据 → 模型基于数据做排序 → 组装结果——每一步都有据可依,模型负责"决策与综合”,工具负责"事实与执行"。ReAct / 规划分工的意义在于:把"一次巨型输出"改成"多次小幅循环",每一步只处理当前需要的信息,让模型的每段决策都聚焦在当前动作上,也让中途出错时只纠正那条支线。这四个部分既是概念上的"是什么",也是代码里"你要自己写/借框架的东西"。
2026-09-30 15:15:12
232
原创 用 Python 轻松调用 Transformers 的实用指南
Transformers 把“调大模型”变成普通的 Python 函数调用,是做 NLP/LLM 应用的事实标准。用 AutoModelForSequenceClassification 微调自己的分类任务;结合 datasets 库加载训练数据;学 peft 做 LoRA 轻量微调,显存占用大幅下降。大模型时代,会调 Transformers 就等于握住了一把万能钥匙。最后说一句,技术成长不只是写代码,职业规划和自我包装同样重要。
2026-09-30 15:04:01
158
原创 LLM 与 RAG 的基本原理
一套系统能听会说,还不足以称为智能体。把语音识别和语音合成直接接在一起,得到的只是一个复读机。让它成为 Agent 的,是中间那个负责决定说什么的环节。但这个环节有两个容易被忽略的性质。一是它没有记忆:所谓的多轮对话,其实是每一轮都把历史重新塞进输入里造出来的。二是它不知道你公司的事:产品手册、订单数据、今天的报价,这些在它训练时都不存在,问到就只能答非所问。本章先拆开每一轮对话的输入是怎么拼出来的,说明模型无状态这一点如何影响成本与延迟;再介绍检索增强生成如何让模型用上私有资料。
2026-09-30 14:46:43
140
原创 Transformers 入门指南:用 Python 调用预训练大模型
Transformers 把“调大模型”变成普通的 Python 函数调用,是做 NLP/LLM 应用的事实标准。用微调自己的分类任务;结合datasets库加载训练数据;学peft做 LoRA 轻量微调,显存占用大幅下降。大模型时代,会调 Transformers 就等于握住了一把万能钥匙。最后说一句,技术成长不只是写代码,职业规划和自我包装同样重要。我整理了一份简历、面试和职业规划的学习资料,适合想在职场上走得更远的朋友看看。
2026-09-29 15:06:40
365
原创 大模型底层架构与AI源码深度解析
大模型的核心能力源自Transformer架构,绝大多数开源AI模型均基于该结构迭代开发。本文从源码层面拆解Transformer基础模块,理解注意力机制、前馈网络的实现逻辑,帮助开发者快速读懂大模型底层源码,掌握AI模型推理阶段的核心计算流程。大模型本质是多层堆叠的编码器结构,核心组件包含多头自注意力层、归一化层、残差连接与前馈神经网络。自注意力机制能够计算序列内每个token之间的关联权重,这也是模型具备上下文理解能力的根源。下面通过极简可运行代码,还原核心模块。
2026-09-29 15:03:07
504
原创 大模型Agent开发入门
AI Agent(人工智能智能体)是当前大模型应用的最前沿方向。与传统问答式AI不同,Agent能自主规划任务、调用外部工具、执行多步骤操作。本文罗列了非常多的AI Agent博文,方便你快速入门。AI Agent是指具备自主决策和环境交互能力的人工智能系统,核心特征包括:自主规划:根据用户目标自动分解任务并制定执行计划工具调用:调用API、数据库、搜索引擎等外部工具扩展能力记忆管理:具备短期和长期记忆,保持多轮交互上下文连贯反思迭代:评估自身输出质量,发现问题后自动调整策略。
2026-09-29 14:59:34
317
原创 一文彻底搞懂:RAG 和大模型的核心关系
从属关系:RAG是服务于大模型的增强技术,依附大模型存在,无法独立工作;互补关系:大模型负责动脑推理,RAG负责找料举证;落地关系:纯大模型负责通用场景,RAG+大模型负责企业私有化、精准、实时的商用场景;取舍关系:补知识、防幻觉、实时迭代选RAG;改能力、调风格、优化推理逻辑选微调。对于AI开发者而言,弄懂RAG和大模型的关系,是入门大模型工程落地的第一步。很多同学只会调模型API,却不懂RAG架构,最终无法独立完成企业级项目。真正的商用大模型应用,从来不是单一模型调用,而是。
2026-09-29 14:56:38
491
原创 微调不是万能药:企业大模型落地的冷静思考
企业大模型落地,最容易犯的错误是把微调当成"用自己的数据"的默认路径。但微调本质上是一种改变模型行为模式的手段,它有明确的适应症,也有明确的代价。大多数企业的多数场景,通用模型加 RAG 加精心设计的提示词就能覆盖。真正需要微调的,往往是那些对输出风格、决策逻辑有强约束的核心业务环节。先 RAG,再提示词,最后微调。这个顺序不是保守,而是对成本结构的尊重。想清楚"不微调能不能解决",比急着"微调一个自己的模型"更重要。微调是一把好刀,但好刀要用在对的地方。
2026-09-29 14:53:56
311
原创 前端可以转型AI工程师吗?那可太能了...
时代的浪潮从未停歇,从互联网到移动端,再到如今的AI,每一次技术范式转移,都不仅仅是工具的迭代,更是一次价值的重新洗牌与职业角色的深刻重塑。折腾死还是等死,总得选一个。AI要替代的,从来不是哪个具体的岗位,而是那些可以被标准化、被数据穷举的“人事物”。如果要跳出被替代的部分,那就要要去很多非标准化的事,而这其实对各位前端其实不难,单看各位想不想罢了...
2026-09-28 16:12:36
431
原创 从Agent到大模型,我踩了5个坑,学习到了这些教训
从Agent到大模型,我踩了5个坑,学习到了这些教训在我们迈向大模型的过程中,我经历了一段让人兴奋又艰辛的旅程。随着AI技术的发展,从Agent的简单功能到大模型的复杂应用,我踏入了多个坑,每一个坑都带来了珍贵的教训。以下是我的探索过程与经验分享,希望能为同样追求技术进步的你们提供一些启示。
2026-09-28 16:05:55
407
原创 探索LangChain的四大核心支柱,让我受益匪浅
LangChain已从一个独立的开发框架,成长为一个覆盖智能体系统全生命周期的技术生态。该生态由四大核心支柱构成:LangChain、LangGraph、Deep Agent与LangSmith。
2026-09-28 15:53:21
345
原创 从 LangChain 到 LangGraph:用「网状工作流」解锁多 Agent 协作的正确姿势
从 LangChain 到 LangGraph,本质是从"线性编排"到"网状编排"的一次升级。多 Agent 不是为了炫技,而是为了在 Prompt 越来越长、任务越来越复杂的今天,让每一个"大脑"都能专注于自己那点事。好的架构不是把所有能力塞给一个 Agent,而是让每个 Agent 只做它最擅长的事。最后说一句,技术成长不只是写代码,职业规划和自我包装同样重要。我整理了一份简历、面试和职业规划的学习资料,适合想在职场上走得更远的朋友看看。
2026-09-28 15:43:34
435
原创 评估LLM在Agent中的安全性:我总结了5个关键点
LLM 选型与评估 是 AI Agent 技术体系中的重要组成部分。简单来说,它涉及到 Agent 如何在 大语言模型集成 层面实现智能化的行为和决策。在实际应用中,LLM 选型与评估 的核心目标是让 Agent 能够更加高效、准确地完成特定任务。这需要我们深入理解其底层原理和实现机制。从学术角度来看,LLM 选型与评估 的研究可以追溯到人工智能的早期阶段。早在 1950 年代,Alan Turing 就提出了关于机器智能的基本设想。
2026-09-28 15:34:44
311
原创 AI时代java程序员都失业了吗?
AI时代Java依然很香,主战场是【企业级大模型应用后端】;不适合模型训练/科研,主打把大模型能力接入金融、政企、ERP、存量业务系统。Python造模型,TS做Web产品,Java负责企业生产级后端和AI业务编排。
2026-09-27 15:17:52
344
原创 通向AGI 之路:大型语言模型(LLM)技术精要
当对话长度超过窗口容量时,更优雅的解决方案是"总结压缩":用LLM将早期对话提炼为摘要,仅保留核心信息。例如,将10轮关于项目需求的讨论浓缩为"用户需要一个支持多语言的客户管理系统,预算5万元"。这种方法的精妙之处在于"动态平衡":保持最近的几轮对话原文,同时将更早的内容持续压缩。当令牌数接近阈值时,系统自动触发总结流程,用摘要替代原始对话。这既节省空间,又最大限度保留了上下文连贯性,但代价是额外的计算成本和潜在的信息损耗——微妙的语气或隐含意图可能在压缩中丢失。
2026-09-27 15:11:56
579
原创 LLM在AI Agent中的运用:我发现的3个关键点
在当今的人工智能(AI)领域,预训练的大语言模型(LLM)在智能体(AI Agent)中的应用正在不断扩展。经过一段时间的探索,我发现了LLM在AI Agent运用中的三个关键点:特性差异、性能优化和生态扩展。接下来,我将详细分享这三个关键点,并提供相关的结构、代码示例和图表展示。
2026-09-27 15:06:59
328
原创 大模型底层架构与AI源码深度解析
大模型的核心能力源自Transformer架构,绝大多数开源AI模型均基于该结构迭代开发。本文从源码层面拆解Transformer基础模块,理解注意力机制、前馈网络的实现逻辑,帮助开发者快速读懂大模型底层源码,掌握AI模型推理阶段的核心计算流程。大模型本质是多层堆叠的编码器结构,核心组件包含多头自注意力层、归一化层、残差连接与前馈神经网络。自注意力机制能够计算序列内每个token之间的关联权重,这也是模型具备上下文理解能力的根源。下面通过极简可运行代码,还原核心模块。
2026-09-27 14:55:23
191
原创 我的企业Agent构建之路:如何从零开始掌握大模型
本文探讨了企业Agent在构建过程中常遇到的问题,强调本体虽然重要,但不应是万能容器。文章提出将Agent所需知识分为四类:世界知识、领域与业务语义知识、任务与过程性知识、情境与状态知识,并阐述了每类知识的典型载体和不能替代的内容。同时,文章强调了本体在知识架构中的关键位置,但不应承担所有责任。最后,文章指出企业需要的是一套合理的知识架构,让不同知识各归其位,帮助Agent更好地理解并参与业务。
2026-09-23 14:14:41
474
原创 如何快速上手使用编程 Agent?新手必看指南
在当今这个快速发展的科技时代,AI 和编程 Agent 的使用愈发广泛。无论是进行代码生成,还是自动化日常任务,编程 Agent 都可以大大提高我们的工作效率。然而,对于刚入门的新手来说,如何快速上手这些工具呢?本文将带您从错误分析、根因分析到解决方案分步了解编程 Agent 的使用方法。
2026-09-23 14:06:05
302
原创 从 AI 助手到自主智能体:办公生产力的进阶路径
几年,AI办公工具快速普及,多数职场人早已习惯使用AI助手完成文案润色、内容问答、简单总结等基础工作。但传统AI助手属于被动式工具,只能响应单次指令、完成碎片化任务,面对多步骤、复合型办公事务,仍需要人工拆分流程、衔接任务、整合结果。随着大模型技术持续迭代,办公智能化完成从“单点AI助手”到“自主AI智能体”的升级,实现任务自拆解、流程自调度、批量自执行,成为办公生产力升级的核心进阶路径。
2026-09-23 13:42:57
228
原创 大模型工具如何构建技术架构:从分层设计到落地实践
总而言之,大模型工具技术架构的本质,是以大模型为智能决策核心,以模块化工具为业务执行载体,以四层分层架构为整体支撑体系,实现AI能力从“纯文本生成”向“业务落地执行”的核心跨越。分层解耦的设计既保障了系统的安全性、稳定性与可维护性,又具备极强的场景拓展能力,可适配轻量化个人应用与大型企业复杂业务场景。随着AI智能体技术的持续迭代,大模型工具架构将朝着自主规划、自主运维、自我迭代的方向升级,成为企业数字化、智能化转型的核心技术底座。最后说一句,技术成长不只是写代码,职业规划和自我包装同样重要。
2026-09-23 13:40:12
446
原创 AI工作流全链路自动化落地实践
AI工作流全链路自动化,旨在打通数据接入、模型推理、结果校验、数据输出全流程,通过编排任务节点,减少人工介入,实现AI任务批量、稳定执行。传统AI调用方式多为单次接口请求,无法处理多步骤、依赖关系复杂的业务场景。本方案基于任务编排思想,构建可复用的AI工作流,支持串行、分支条件判断、异常重试,适用于文本解析、内容生成、数据提取等业务。AI工作流自动化不是简单串联API,而是通过节点化编排,实现数据预处理、AI推理、结果处理的标准化流程。
2026-09-23 13:34:35
235
原创 【通俗易懂】大白话讲解 Transformer
自然语言处理(Natural Language Processing,NLP)技术的发展是一个逐步迭代和优化的过程。在 Transformer 架构出现之前,该领域经历了从依赖人工规则和知识库到使用统计学和深度学习模型的转变。Transformer 的出现标志着自然语言处理进入一个新时代,特别是随着 BERT 和 GPT 等模型的推出,大幅提升了自然语言的理解和生成能力。现在,基于 Transformer 架构的应用正在经历一个前所未有的爆发期。
2026-09-22 14:59:57
121
原创 多 Agent 协作:从单兵作战到智能体集群的架构演进
随着大语言模型(LLM)推理能力的指数级提升,传统的“单 Agent 完成单一任务”的模式正逐渐显露出瓶颈。当开发者试图构建一个具备规划、记忆、工具调用及自我修正能力的复杂系统时,单点智能体容易陷入“幻觉循环”或逻辑死胡同。本文旨在探讨多 Agent 协作开发的最佳实践。我们将深入剖析如何设计一个能够动态分配任务、进行自我反思并协同工作的智能体集群。
2026-09-22 14:55:14
147
原创 连接万物智能:MCP 协议如何重塑 AI 编程生态
在当前的 AI 开发浪潮中,大语言模型(LLM)的能力边界正以前所未有的速度扩展。从单纯的文本生成到复杂的代码编写、数据库查询甚至系统运维,AI Agent(智能体)正在成为开发者不可或缺的副驾驶。然而,随着智能体数量的激增,一个核心痛点日益凸显:上下文隔离与工具调用的混乱。传统的 AI 应用往往采用“硬编码”的方式将工具(Tools)和知识库(Resources)与模型绑定。
2026-09-22 14:47:23
381
原创 RAG 流程背后的逻辑:实现流式输出的关键因素
RAG 流程背后的逻辑:实现流式输出的关键因素在最近的项目中,我持续探索了 RAG(Retrieval-Augmented Generation)流程的背后逻辑,特别是如何实现流式输出的关键因素。由于流式输出能够在实时场景中提供动态反馈和交互性,理解其运作机制对开发 AI 助手和多模型聚合聊天系统至关重要。接下来,我将分享我在这个过程中的一些见解和解决方案。
2026-09-22 14:39:31
181
原创 大模型时代,AI 工程师如何零门槛玩转知识图谱(附代码)
看到这里,你可能会发现,图数据库的节点增删改查逻辑跟传统数据库本质上是一脉相承的。在实际的项目开发中,作为 AI 工程师,你不需要去背太复杂的图计算函数和多层嵌套查询语句。真正的业务链路往往是这样的:后台数据 Pipeline: 工程师编写 Python 脚本或基础 Cypher 代码,将结构化/半结构化数据清洗入库,构建出节点和关系(也就是知识图谱)。线上检索交互: 用户使用自然语言提问(如:“帮我查一下在北京的科技公司有哪些?
2026-09-22 14:15:28
135
原创 从模型工具到业务闭环:大模型时代开发效率升级路径
大模型技术全面普及后,软件开发模式正在经历结构性变革。早期开发者使用AI仅停留在代码补全、单行纠错等单点工具能力,只能解决局部低效问题,无法改变整体开发节奏。随着行业逐步走向深度落地,开发升级路径从“零散使用模型工具”转向“搭建完整业务闭环”。通过模型工具贯穿需求梳理、代码开发、逻辑优化、数据处理、成果输出全链路,打通开发与业务的壁垒,实现项目从0到1的高效落地,完成开发效率的系统性升级。
2026-09-21 14:19:11
120
原创 AI Agent大模型架构:我如何解决多Agent协作的挑战
工程上,评估不应只看单次输出,而要覆盖感知-决策-行动循环:感知是否准确进入决策,决策是否被行动正确执行,行动结果是否回流到下一轮感知。资料指出,LLM作为Agent大脑具有优势,同时LLM-based Agent的评估、安全性,以及增加Agent数量的方法及挑战,都是必须讨论的问题。总体看,基于大模型的AI Agent工程化,核心不是堆叠概念,而是划分模块职责与LLM协作边界,权衡单Agent与多Agent的复杂度,并把评估和安全性作为架构的一等公民。单Agent与多Agent的选型,需要回到任务本身。
2026-09-21 13:59:23
164
原创 从“能说”到“能做”:一文讲透 LLM 与 Agent 的本质区别
LLM 和 Agent 的关系,不是替代,而是扩展。LLM 提供了前所未有的语言理解和推理能力,这是 Agent 能够“理解目标、制定计划”的基础。但 Agent 在这之上,补全了 LLM 缺失的关键能力:记忆、工具、规划和反思。新华网的访谈中有一个判断值得深思:如果说大模型赋能的是人类的“认知生产”,那么智能体赋能的则是完整的“任务执行流程”。这是从量变到质变的范式跃迁。从“能说”到“能做”,这中间隔着的,正是一整套让语言智能得以作用于现实世界的系统框架。
2026-09-21 13:50:35
285
原创 AI Agent 工作原理及代码示例
AI Agent(人工智能智能体)是一种以大语言模型(LLM)为核心,能够感知环境、自主规划、调用工具并执行任务以实现特定目标的自治系统。它与传统AI或脚本工具的本质区别在于其具备“感知-思考-行动-观察”的闭环机制,能够从“被动响应”转向“主动执行”。
2026-09-21 13:43:18
262
原创 Agent 和 Skill 有什么区别?一份开发指南讲透
最后说一句,技术成长不只是写代码,职业规划和自我包装同样重要。我整理了一份简历、面试和职业规划的学习资料,适合想在职场上走得更远的朋友看看。岗位说明书、工作流程文档、写好的提示词都可以,AI 会从中提取角色定义、SOP、输出规范,直接转化成专家包。如果你想看完整资料目录,可以在评论区留言「资料」;:Agent 可以装 Skill,Skill 里不会装 Agent。直接说「帮我创建一个 XX 专家」,由内置能力自动完成。
2026-09-20 15:43:16
411
3
原创 AI大模型之深度学习
AI 大模型的本质,是深度学习在数据、算力、架构和目标函数上的系统性放大。它的核心仍然是神经网络、反向传播和梯度下降;它的突破来自 Transformer、自注意力和预训练目标;它的落地依赖微调、RAG、Agent 和推理优化。深度学习让机器学会表示,大模型让机器学会通用。理解深度学习,才能真正理解大模型;掌握工程方法,才能把大模型变成产品。工具会变,架构会变,但“用数据训练网络,用误差调整参数”的底层逻辑,仍将长期成立。最后说一句,技术成长不只是写代码,职业规划和自我包装同样重要。
2026-09-20 15:38:43
132
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅