自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

寻道AI,探索AI无限可能!

探索未知,分享所知。作为一名系统架构师,我曾带领团队打造多个行业领域的系统平台。如今,我正踏上AI大模型的探索之旅,期待与你一起成长,迎接技术的未来。

  • 博客(829)
  • 资源 (8)
  • 收藏
  • 关注

原创 大模型工程化实战(十三):LLMOps 不完全指南——LLMOps 与 MLOps 的区别到底在哪:发布原子不是模型,是 Prompt/数据/模型版本三元组

本文揭示LLMOps的核心:一次可信发布的原子单位不是单个模型或Prompt,而是“版本三元组”——即Prompt、数据、模型三者的不可变组合。 作者以亲身事故为例,指出仅管理零件不等于管理发布,导致回滚无据。提出“六站流水线”方案:从注册、评测、发布到观测、反馈与退化监控,将前12篇独立构建的组件串联成可复现、可回滚的飞轮系统。关键在于单一变更原则与三元组指纹,确保每次发布身份清晰、责任可溯。

2026-09-23 08:00:00 236 5

原创 大模型工程化实战(十二):RAG 数据工程底座——采集到入库流水线(离线+在线双链路)

本文聚焦知识库建设的“数据工程底座”构建,指出人工补料无法应对上游出料速度,根源在于缺乏自动化、可追溯的数据流水线。提出六段式流水线:采集(来源管控)、清洗(四道过滤闸)、切片(按类型分层切)、向量化(模型接口封装)、版本/血缘/权限管理、双链路更新(离线批量与在线增量隔离)。通过标准化流程实现文档从源头到入库的持续、干净、可追溯供给,支撑第11篇提出的换版、巡检等治理机制,真正筑牢知识库“粮仓地基”。

2026-09-21 08:00:00 646 25

原创 大模型工程化实战(十一):知识库防腐坏——巡检揪出缺/腐/乱、治理先软下架止血、灰度换版可回滚:模型没换、prompt 没换,RAG 正确率却往下掉,先别查模型,查粮仓

第 10 篇《Human-in-the-Loop 反馈闭环》结尾我讲过一句话:闭环筛到最后,还剩一类我处理不了的样本:用户问的知识点,模型答得没错,是知识库里根本没有、或者躺着过期版本。我原以为这话是说给别人听的,直到上周自己踩进去。用户问“新款 X100 的保修政策”,检索把这句拆开,top 结果回了一页旧文档:库里根本没有 X100 的保修页,躺在那的是上一代 X90 的过期保修政策。我顺手把整库过了一遍,越查越心虚:该有的新政策没有,过期的旧政策当宝,同一款 X80 的“官方参数”在检索结果里三个版本

2026-09-16 08:00:00 637 41

原创 大模型工程化实战(十):Human-in-the-Loop 反馈闭环——三层清洗打造 Golden Set,拒绝“点赞即真理”

第 9 篇《Token 成本六维优化》结尾我说过一句话:再压就伤质量,而伤没伤,评测集说了不算——线上真实用户觉得行不行,得有人把话递回来。我把话递回来的方式很朴素:给每个回答挂上点赞点踩,攒够一批回灌 golden set,让质量底线跟着真实反馈走。上线第一周数据漂亮得不像话——500 条反馈,一片叫好。团队兴冲冲把“被赞最多的输出”当 gold 灌进评测集,第二周评测分数开始说胡话:某个被用户狂赞的回答,人工一查是“顺耳但错”的流畅幻觉。那一刻我明白:**把“用户觉得好”直接当“答案是对的”,评测集就废

2026-09-14 08:00:00 536 28

原创 大模型工程化实战(九):Token 成本六维优化——把 token 账本摊开算:缓存命中、上下文裁剪、小模型路由、重试预算,一份 mock 日流量实测省 60% 成本

月初我对账单,厂商后台那个总额吓我一跳。查下来模型没调价、业务量也没暴涨,可账单比上月翻了快一倍——问题不是模型贵,是没人算过账。Token 成本是算出来的业务属性,厂商账单只给一口价总额,我把它拉出来一摊,最烧钱的那条链自己就浮出来了。钱大头不在“干活”的输出,而是每次请求重发的 system 前缀、RAG 每问拖回来的 8 篇文档、fallback 到大模型那几条链,还有重试把调用翻倍。

2026-09-09 08:00:00 554 37

原创 大模型工程化实战(八):OTel + LangFuse 全链路 Trace——把网关、护栏、SchemaGate 全部打点串起来,出问题一眼定位到环节

凌晨一点,`schema_validation_exhausted` 这条结构化告警第三次亮起。下游没崩、没有 500,可“为什么偏偏这单走兜底”连我也答不上来:网关日志显示主路超时、重试 2 次兜到 gpt4;护栏日志显示 medium 风险 strip 放行;SchemaGate 日志显示缺“金额”字段、类型错、重试耗尽。三份日志都对,时间戳也对得上,人肉拼了两小时才凑出因果链。全链路 Trace 治的就是这个毛病:可观测不等于“每环节都打日志”

2026-09-07 08:00:00 910 26

原创 大模型工程化实战(七):JSON Schema 强约束——模型吐的 json 不合规?schema 校验不通过,重试、兜底、降级一条龙

针对模型输出不合规JSON导致下游崩溃、静默NaN或工具传参错误,本文提出输出侧第二道物理闸:JSON Schema结构校验。方案先脱敏(上篇),再经SchemaGate锁格式:校验失败则带反馈重试,超预算返回结构化error object而非500。探讨了四种技术路线(校验+重试、厂商structured output、语法约束采样、json_repair),并给出离线可跑的demo。

2026-09-02 08:00:00 919 35

原创 大模型工程化实战(六):OWASP LLM 2025 安全护栏——prompt injection 拦截 + 敏感信息脱敏的最小实现

上线第三周,客服 AI 当着客户的面,把身份证号完整念了一遍。用户那头就一句话:“帮我查一下订单。”——一个攻击性的字眼都没有,是知识库里一条“用户要求核对时输出完整信息”被检索带进了上下文。这就是 OWASP 2025 说的间接注入,RAG 生产态的首要泄露入口。这篇给网关挂两道闸:输入前置拦截 prompt injection,输出后置敏感信息脱敏。上篇留过一句:网关能力清单里“安全钩子”两行是提前留好的挂载点——钩子有了,闸没挂。纯标准库、离线可验,不把用户数据送给第三方审核 API。

2026-08-31 08:00:00 1178 31

原创 大模型工程化实战(五):LLM 网关到底怎么选 - 2026 自研 / LiteLLM/Portkey/Kong/One API 全面对比

registry 上线第二周,转人工率又爬回来了。这次不是回滚错版本——是回滚了也没用:值班同学把版本指针切回旧版,等了十分钟,曲线没下来。查日志才看清:线上压根没人按版本 ID 路由——三个服务直连 LLM API,各自写各自的重试,key 散在三个环境变量里,只有一处接了 registry 的 get()。这篇是 LLM 网关选型,但我先不摆参数,只回答一个问题:什么规模,选什么网关,才能让“按版本 ID 路由 Prompt”落地。答案先放这儿:registry 管的是资产,网关管的是路由

2026-08-26 08:00:00 992 27

原创 大模型工程化实战(四):Prompt 版本管理——把提示词做成可 diff、可评审、可回滚的代码资产

Prompt 版本管理:从字符串到工程资产 本文探讨了Prompt管理从随意修改走向工程化的完整方案。当前Prompt管理存在三大痛点:(1)热修改无版本记录,(2)与代码耦合导致回滚粒度粗,(3)缺乏评审机制直接上线。这些问题的核心在于Prompt未被当作"代码资产"管理。 解决方案提出"Prompt即代码"理念,赋予Prompt五项代码待遇: 版本化:用内容哈希作为唯一身份标识,语义版本仅作标签 评审机制:结合人工diff与自动化校验(占位符检查/token预算/契约验证) CI集成:触发最小评测回归,

2026-08-24 08:00:00 1028 36

原创 大模型工程化实战(三):LLM 灰度发布 + 自动熔断,1% 流量试错、指标劣化自动回滚

本文探讨了AI系统灰度发布中的关键问题与解决方案。通过一个真实事故案例(因优化Prompt导致回复过短而引发转人工率飙升),指出离线评测的局限性——它只能反映历史数据,无法捕捉线上动态变化。文章提出了一套完整的线上验证框架:影子验证(新旧版本并行比对)、分层放量(1%-100%分五档双门禁控制)和智能熔断(快慢双层的阈值判定)。重点解析了熔断阈值的统计原理(如违规3次法则、3σ校准)和状态机设计(CLOSED/OPEN/HALF_OPEN三态流转),强调监控必须从"被动看"升级为"主动盯"。核心结

2026-08-19 08:00:00 1076 44

原创 大模型工程化实战(二):Golden Set + CI 评测,给LLM内容上量具

本文针对AI应用中"格式正确但内容错误"的问题,提出了一套完整的质检解决方案。通过构建分层评测集(Golden Set)作为标尺,采用三级级联评测体系(确定性检查→轻量语义→LLM裁判)作为量具,配合统计门禁机制进行判罚。方案特别强调评测集的版本化管理、样本规模统计推导(建议250条起)和标注纪律(标注一致性κ≥0.7),将主观的内容正确性问题转化为可量化的工程约束。该体系可有效捕捉5pp以上的质量下滑,相比传统人工抽查方式显著提升问题检出率。

2026-08-17 08:00:00 1025 27

原创 大模型工程化实战(一):概率坍塌的救赎 - 给LLM输出加锁

本文探讨了如何解决大模型输出不稳定的工程问题,提出了4层确定性金字塔方案。文章指出大模型输出不稳定性体现在三个层面:输出随机破坏用户体验、格式错乱导致系统中断、偶发幻觉造成业务污染。传统应对方法如依赖temperature=0、加强prompt约束或更换模型都存在本质缺陷。 核心方案是通过4个层级递进增强确定性:采样层(temperature=0+seed)提供基础稳定性;契约层(JSON Schema严格校验)确保格式合规;容错层(校验+重试+降级)控制失败成本;编排层(状态机控制流)实现业务级确定

2026-08-10 08:00:00 828 11

原创 大模型工程化实战(序):AI落地,Demo之后才是真战场

算法定义AI的能力天花板,工程化守住AI的商用生命线。

2026-07-29 08:00:00 551 13

原创 LangChain4j Java AI 应用开发实战(三十):Agentic 智能客服实战(下)—— RAG + 记忆 + 流式集成

本文接续上篇,深入 Agentic 智能客服的三大基础设施:RAG 检索增强生成(政策文档加载→切分→向量化→存储→检索的完整管线)、ChatMemory 多用户对话记忆(@MemoryId 隔离 + InMemoryChatMemoryStore + MessageWindowChatMemory)、Flux\<String\> SSE 真流式输出(Spring MVC 原生支持,无需 WebFlux)。你将掌握从文档到向量的完整 RAG 工程流程、多用户会话隔离的正确实现、以及 LangChain4j

2026-07-24 08:00:00 477 3

原创 LangChain4j Java AI 应用开发实战(二十九):Agentic 智能客服实战(上)—— Agent 设计与工具编排

本文以电商售后智能客服为业务场景,深入讲解 LangChain4j Agentic AI 的核心设计范式:**1 个 @AiService + 多组 @Tool**。你将掌握:如何按"能力类型"而非"业务流程"分组工具、LLM 自主路由的实现原理与调优技巧、系统提示词如何定义 Agent 的人格与行为边界、以及 @Tool 注解的最佳实践。本文不写一行 Java 路由代码,让 LLM 自己决定调用哪个工具。

2026-07-23 08:00:00 535 3

原创 LangChain4j Java AI 应用开发实战(二十八):MCP 协议 —— 安全的工具与数据源接入标准

本文深入讲解 MCP(Model Context Protocol)协议的原理与实战,通过"文件读取 Bot"和"百度地图查询助手"两个完整案例,你将掌握 MCP 的两大传输模式(Stdio 子进程通信 与 HTTP/SSE 远程调用)、学会如何通过 `McpToolProvider` 将远程 MCP 服务器暴露的工具动态注入到 LangChain4j 的 AI Service 中、对比 MCP 与自定义 `@Tool` 注解的核心差异。同时我们还会深入分析 MCP 的安全沙箱设计、资源访问的白名单机制、以

2026-07-01 08:00:00 1069 6

原创 LangChain4j Java AI 应用开发实战(二十七):Ollama 本地模型部署 —— 隐私保护与离线运行

本文深入讲解如何通过 Ollama 在本地部署和运行开源大模型,实现零成本、零网络依赖、数据不出本机的 AI 能力。你将掌握 Ollama 的三种部署方式(手动安装、Docker Compose、Testcontainers 自动化)、LangChain4j 的 `OllamaChatModel` 同步调用与 `OllamaStreamingChatModel` 流式输出、结构化 JSON Schema 输出、以及 GPU 加速配置和性能调优。同时我们还会对比 Llama 3.1、Qwen2.5、DeepS

2026-06-30 08:00:00 501 2

原创 LangChain4j Java AI 应用开发实战(二十六):多模型集成策略 —— OpenAI、DeepSeek、阿里百炼混合使用

本文深入讲解如何在单个 Spring Boot 项目中同时接入多个 AI 模型提供商(OpenAI、DeepSeek、阿里百炼 DashScope、Ollama),通过 `@AiService(wiringMode = EXPLICIT)` 实现声明式的模型绑定、理解多 ChatModel Bean 的共存机制、掌握模型路由的三种策略(基于任务类型、基于成本、基于负载/故障转移)。同时我们还会分析统一接口抽象的价值、Token 成本对比、以及多模型架构在企业级应用中的最佳实践。

2026-06-29 08:00:00 987 2

原创 LangChain4j Java AI 应用开发实战(二十五):A2A 协议 —— Agent 之间的通信与协作

本文深入讲解 A2A(Agent-to-Agent)协议的原理与实战,通过"创意写作 + 风格润色"的跨 Agent 协作案例,你将掌握 A2A 协议的核心概念(AgentCard 服务发现、JSON-RPC 2.0 通信标准、任务状态管理)、学会搭建 A2A 服务端(Spring Boot + JSON-RPC Controller)、理解客户端如何通过 `a2aBuilder()` 像调用本地 Agent 一样调用远程 Agent。同时我们还会分析 A2A 的安全性设计、与 Supervisor 编排的

2026-06-28 15:35:58 460 2

原创 LangChain4j Java AI 应用开发实战(二十四):人机协同与非 AI Agent —— 混合执行系统

本文深入讲解 LangChain4j Agentic 框架中的两种特殊 Agent 类型——NonAI Agent(纯代码逻辑代理)和 HumanInTheLoop(人工介入代理)。通过完整招聘系统的实战案例,你将掌握如何将确定性 Java 方法与 AI Agent 无缝混排、如何在关键时刻暂停工作流等待人工审批、以及如何设计 AI + 代码 + 人类三者协同的混合执行架构。学完本文,你将能构建更高效、更可靠、更安全的企业级 Agent 系统。

2026-06-26 11:19:00 518 1

原创 LangChain4j Java AI 应用开发实战(二十三):主管编排与组合工作流:智能调度与模式嵌套

本文深入讲解两种高级 Agent 编排模式:主管编排(Supervisor Orchestration)和组合工作流(Composed Workflows)。通过招聘系统的实战案例,你将掌握如何让 Supervisor Agent 自主调度多个子 Agent、理解与条件分支的区别、学会将多种工作流模式(顺序+并行+循环+条件)嵌套组合成复杂系统。同时我们还会分析状态管理、数据传递、性能优化等企业级特性,帮助你构建具备智能决策能力的复杂 AI 应用系统。

2026-06-24 08:00:00 495 1

原创 LangChain4j Java AI 应用开发实战(二十二):条件分支 - 智能路由与动态决策

本文深入讲解条件分支工作流的设计与实现,通过简历评审后的智能决策案例(高分安排面试、低分发送拒绝邮件、缺失信息请求补充),你将掌握如何根据运行时状态动态路由到不同的 Agent、理解三种路由策略(硬编码条件、分类模型、LLM 自主决策)、学会配置 Fallback 策略处理边界情况。同时我们还会分析同步与异步条件执行的差异、路由器的设计模式、以及最佳实践,帮助你构建具备智能决策能力的 AI 应用系统。

2026-06-20 08:00:00 430 3

原创 LangChain4j Java AI 应用开发实战(二十一):并行工作流 - 多 Agent 协同执行与结果聚合

本文深入讲解并行工作流的设计与实现,通过 HR、经理、团队成员三方同时评审简历的实战案例,你将掌握如何让多个 Agent 并发执行以加速任务完成、理解四种结果聚合策略(拼接、投票、加权、摘要)、学会配置线程池和异常处理(onError 策略)。同时我们还会分析并行工作流的性能优势(提速比计算)、适用场景和最佳实践,帮助你构建高效的分布式 AI 应用系统。

2026-06-19 08:00:00 487 1

原创 LangChain4j Java AI 应用开发实战(二十):循环工作流 - 自动迭代直到质量达标

本文深入讲解循环工作流的设计与实现,通过简历评审 → 简历优化的迭代案例,你将掌握如何设置退出条件(质量评分阈值、最大迭代次数)、避免死循环的策略、追踪迭代历史、以及如何处理"永远无法达标"的边界情况。同时我们还会分析循环工作流的适用场景、性能特点和最佳实践,帮助你构建具备自我修正能力的智能系统。

2026-06-18 08:00:00 512 2

原创 LangChain4j Java AI 应用开发实战(十九):顺序工作流 - 多阶段流水线设计模式

本文深入讲解顺序工作流的设计与实现,通过简历生成 → 简历优化的实战案例,你将掌握如何将多个 Agent 串联成流水线、理解数据传递机制(outputKey 匹配规则)、学会使用类型化与无类型两种编程模式、以及如何提取和访问工作流的内部状态。同时我们还会分析顺序工作流的适用场景、性能特点和最佳实践,为你构建生产级多阶段 AI 应用打下坚实基础。

2026-06-17 08:00:00 313 2

原创 LangChain4j Java AI 应用开发实战(十八):Agentic AI 入门 - 理解核心概念与单步 Agent

本文是 Agentic AI 系列的开篇之作,带你理解什么是 Agentic AI、为什么需要它、以及 ReAct 模式的核心原理。通过简历生成器(CvGenerator)这一最简实战案例,你将掌握如何定义 Agent 接口、创建 Agent 实例、调用 Agent 执行任务。同时学习 AgenticScope 的基础概念和 outputKey 机制,为后续深入学习各类工作流编排模式奠定理论基础。

2026-06-16 08:00:00 426

原创 LangChain4j Java AI 应用开发实战(十七):企业知识库实战 - 从文档导入到智能问答

本文带你从零构建一个生产级的企业知识库问答系统,涵盖 Apache Tika 多格式文档解析、自定义文档分割策略、增量索引更新、Spring Boot REST API 设计、对话记忆管理、工具调用集成等企业级特性。通过美团外卖客服机器人实战案例,你将掌握如何将 RAG、ChatMemory、Tools 三大核心技术栈整合到一个完整的 Web 应用中,并学习性能优化、缓存策略、权限控制等生产环境最佳实践。

2026-06-15 08:00:00 475 1

原创 LangChain4j Java AI 应用开发实战(十六):高级 RAG 技术(下)- 元数据过滤与多检索器融合

本文深入讲解 Advanced RAG 的其他高级技术:元数据注入、元数据过滤、跳过检索、多检索器融合、网络搜索集成和返回来源引用。通过企业文档问答、多用户隔离、混合检索等实战案例,你将掌握如何提升 RAG 系统的可追溯性、精准度和灵活性。同时我们还会分析每种技术的适用场景和性能影响,帮助你在实际项目中做出合理的技术选型。

2026-06-10 08:00:00 901 2

原创 LangChain4j Java AI 应用开发实战(十五):高级 RAG 技术(上) - 查询压缩、路由与重排序

本文深入讲解三大高级 RAG 优化技术:查询压缩(Query Compression)、查询路由(Query Routing)和重排序(Re-Ranking)。通过约翰·多伊传记客服和多知识库问答两个实战案例,你将掌握如何解决多轮对话上下文丢失、多数据源检索效率低下、向量检索精度不足等核心痛点。同时我们还会分析每种技术的性能开销和适用场景,帮助你在实际项目中做出合理的技术选型。

2026-06-09 08:00:00 515 2

原创 LangChain4j Java AI 应用开发实战(十四):手写 RAG 全流程 - 深入理解每个环节

在上一篇文章中,我们体验了 Easy RAG 的便捷——3 行代码就能构建一个完整的 RAG 系统。但你是否好奇:**这 3 行代码背后到底发生了什么?文档是如何被分割的?向量是如何计算的?检索是如何工作的?** 如果将 Easy RAG 比作"自动挡汽车",那么 **Naive RAG(朴素 RAG)** 就是"手动挡汽车"。它不会帮你隐藏任何细节,而是让你亲手操控离合器、油门、变速箱,真正理解 RAG 的工作原理。

2026-06-08 08:00:00 904 1

原创 LangChain4j Java AI 应用开发实战(十三):三行代码实现 RAG - Easy RAG 框架详解

在前一篇文章中,我们深入对比了四大向量数据库的选型策略。但当你真正开始构建 RAG(检索增强生成)应用时,可能会发现:**配置向量数据库、设计文档分割策略、管理嵌入模型、编写检索逻辑……这些步骤太繁琐了!** 有没有一种方式,能够像"Hello World"一样简单,3 行代码就搞定 RAG?

2026-06-07 08:10:52 545

原创 LangChain4j Java AI 应用开发实战(十二):向量数据Chroma/Qdrant/Milvus实践对比

在前一篇文章中,我们学习了 Embedding 模型如何将文本转换为语义向量,并构建了基于内存的文本分类器。但当你需要将成千上万甚至上亿个向量持久化存储并实现毫秒级检索时,简单的内存存储就力不从心了。向量数据库(Vector Database)正是解决这一挑战的核心基础设施,它专门优化了高维向量的存储、索引和相似度搜索。

2026-06-05 12:00:00 1029 1

原创 LangChain4j Java AI 应用开发实战(十一):Function Calling 工具调用 - 让 AI 执行真实操作

本文深入讲解 Function Calling(函数调用)的核心原理,演示如何使用 @Tool 注解将 Java 方法暴露给 AI 模型,让大模型能够自主决定何时调用工具、传递什么参数。通过餐厅预订系统和动态代码执行两个实战案例,你将掌握工具注册、参数绑定、多步工具调用链等关键技术,并了解 ToolProvider 高级用法和安全沙箱机制,为构建企业级 AI 应用打下坚实基础

2026-05-31 08:00:00 625 1

原创 LangChain4j Java AI 应用开发实战(十):Embedding 模型与文本分类 - 语义向量化

在上一篇文章中,我们学习了 Few-Shot Learning 如何通过示例提升模型准确率。但你是否思考过:如何让计算机真正"理解"文本的语义?传统的关键词匹配无法解决"我的包裹在哪里?"和"订单物流状态查询"这类语义相同但无共同关键词的问题。**Embedding(文本嵌入)技术**正是解决这一难题的钥匙,它将文本转换为高维向量,让计算机能够计算语义相似度,从而实现智能搜索、文本分类、推荐系统等应用。

2026-05-30 08:00:00 624

原创 LangChain4j Java AI 应用开发实战(九):Few-Shot Learning - 少样本提示提升模型准确率

直接让 AI 回答问题(Zero-shot)往往效果不稳定,但微调模型又成本高昂、周期漫长。有没有折中方案?Few-Shot Learning(少样本学习)通过在 Prompt 中提供少量示例,就能显著提升模型准确率和一致性。本文将深入讲解 LangChain4j 的 Few-shot 实现技巧,从基础的示例拼接、到动态示例检索、再到 Token 优化策略。你将学会如何构建高质量的示例库,如何在客服意图分类、代码生成等场景中应用 Few-shot,让模型快速"学会"特定任务的处理模式,无需训练即可获得接近微

2026-05-29 08:00:00 509

原创 LangChain4j Java AI 应用开发实战(八):用户隔离与持久化记忆 - 企业级对话系统设计

单用户对话系统很简单,但企业级应用需要支持成千上万用户同时交互,每个用户的对话历史必须严格隔离、重启不丢失。如何实现多用户记忆管理?如何选择合适的持久化方案?本文将深入讲解 LangChain4j 的 `@MemoryId` 注解实现用户隔离、`ChatMemoryProvider` 动态创建记忆实例、以及从内存到 MySQL/Redis 的多种持久化方案。你将学会构建支持高并发的多用户对话系统,掌握会话 ID 生成策略、数据清理机制、线程安全控制等企业级设计技巧,让 AI 应用真正具备生产环境部署能力。

2026-05-28 08:00:00 635 1

原创 LangChain4j Java AI 应用开发实战(七):结构化输出实战 - 从非结构化文本提取 POJO 对象

大模型擅长生成自然语言,但程序需要的是结构化数据。如何让 AI 返回 JSON、Java 对象而非自由文本?LangChain4j 提供了强大的结构化输出能力,能自动将非结构化文本解析为枚举、数值、日期、POJO 等 Java 类型。本文将深入讲解 `@Description` 注解的字段级语义说明、JSON Mode 的强制结构化输出、以及复杂嵌套对象的提取技巧。你将学会如何从简历中提取人员信息、从评论中分析情感、从合同中抽取关键条款,让 AI 真正成为数据提取的利器,大幅提升业务自动化水平。

2026-05-27 08:00:00 573

原创 LangChain4j Java AI 应用开发实战(六):声明式 AI Service - LangChain4j 的核心编程模型

传统的 AI 调用需要手动拼接 Prompt、发送 HTTP 请求、解析 JSON 响应,代码冗长且难以维护。LangChain4j 提供了革命性的声明式编程模型——AI Service,通过定义 Java 接口即可自动获得 AI 能力,无需手写实现类。本文将深入讲解 `AiServices.create()` 的动态代理原理,`@SystemMessage`、`@UserMessage`、`@V` 等核心注解的使用技巧,以及 String、List、Enum、POJO 等多种返回值类型的映射机制...

2026-05-26 08:00:00 596

原创 LangChain4j Java AI 应用开发实战(五):流式响应与对话记忆 - 提升用户体验的关键技术

同步阻塞的 AI 调用让用户等待数秒甚至数十秒,体验极差;没有记忆的对话机器人每轮都是"初次见面",无法进行连贯交流。流式响应和对话记忆是构建优质 AI 应用的两大核心技术。本文将深入讲解 LangChain4j 的 StreamingChatModel 实现逐字实时输出,以及 ChatMemory 管理多轮对话上下文。你将掌握 TokenWindowChatMemory 的滑动窗口机制、MessageWindowChatMemory 的消息数量控制,并通过实战案例构建支持多轮交互的智能客服...

2026-05-25 08:00:00 620

js小技巧:当鼠标移上文字弹出层

js小技巧:当鼠标移上文字或照片的时候可以弹出层 层里面可以是文字、图片、表格

2010-07-16

各领域行业ChatGPT Prompt提示词大全

本资料精心汇编了适用于各行各业的ChatGPT Prompt提示词,旨在帮助用户更高效地利用ChatGPT进行行业分析和内容创作。我们根据不同领域的特征和需求,归纳和整理了一系列有效的Prompt模板和词汇,以便于专业人士快速引导模型生成所需的专业信息或解决方案。 无论您从事的是科技、金融、教育还是医疗行业,或是任何其他专业领域,本资料的Prompt提示词都将助您一臂之力,使您能够更加精准地与ChatGPT沟通,从而提升工作效率、优化输出内容,并发掘更多的应用场景和商业价值。

2024-06-05

CVP架构的企业级知识库落地

1.基于ChatGPT+VectorDB+Prompt架构实现的企业级本地知识库源码; 2.企业可以通过这个知识库来管理和分析自己的数据,比如客户信息、市场调研结果、产品数据等。 3. 利用本地知识库+通过RAG机制实现检索生成增强,落地实现企业级本地知识库机器人方案。(为了提高检索的效率和准确性,采用了RAG(Retrieval-Augmented Generation)机制。这是一种先进的信息检索技术,它结合了传统的关键字检索和最新的生成模型技术。通过RAG机制,系统能够理解用户的查询意图,然后从知识库中检索出最相关的信息,最后通过生成模型将这些信息整合成有用的答案)

2024-05-26

Java面试专题及答案大全各类经验分享

Java面试专题及答案等,多个技术点面试大全;阿里百度美团面试题集合,各类经验分享

2024-04-16

Embedding-评论数据集

Embedding-评论数据集

2024-04-05

任意获取鼠标点击处的位置坐标

获取鼠标的坐标,通过js任意获取鼠标点击处的位置坐标。

2010-12-17

js实现定时隐藏div

js实现定时隐藏div层,任你设置时间,时间一到立即隐藏

2010-12-17

初学者必备资料-php-ext学习

初学者必备的学习PHP-EXT资料,详细实列

2010-09-10

jquery匹配搜索

jquery就匹配搜索功能。模拟百度搜索栏,输入关键字自动提示。。。。

2010-11-22

jquery表单验证

jquery表单验证,jquery实现各种各类的无刷新表单验证。

2010-11-06

jquery技巧总结

jquery技巧总结,轻松,简单学习jquery.

2010-11-06

面试必备十五问,面试难题预先知

在应聘的过程中,总会遇到一些难缠的问题,令人一时不知如何招架。当然这些问题并没有标准答案,个人以为,胜出的关键,是事先对应聘单位需要什么样的人有所了解,既“投其所好”,又诚信而本色地展示自我

2010-07-11

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除