- 博客(1115)
- 资源 (2)
- 收藏
- 关注
原创 LlamaIndex 系列【41】数据连接器:LlamaParse、LiteParse
数据连接器(也称为Reader读取器)用于从不同数据源、不同数据格式中读取数据,并将其转换为统一的Document文档对象(包含文本与基础元数据)。
2026-09-29 10:23:13
199
原创 LlamaIndex 系列【40】存储组件:文档存储(Document Stores)
默认情况下,SimpleDocumentStore 在内存中存储Node对象。你可以调用docstore.persist()将数据持久化到磁盘;也可以通过SimpleDocumentStore.from_persist_path(...)从磁盘加载数据。
2026-09-28 17:00:47
189
原创 LlamaIndex 系列【39】存储组件:对话存储(Chat Stores)
对话存储提供统一接口来存放对话历史。对话历史与其他存储格式不同:消息顺序对完整会话至关重要
2026-09-28 15:42:37
64
原创 LlamaIndex 系列【38】存储组件:向量存储(Vector stores)
向量存储用于存放已摄取文档分片的嵌入向量(部分向量存储也会直接保存文档分片本身)。
2026-09-28 15:19:06
180
原创 LlamaIndex 系列【37】结构化输出(Structured Outputs):进阶案例
structured_predict 是 LLM 基类的格式化问答函数,给一个 Pydantic 类和一个提示词模板,返回填充好的 Pydantic 实例。
2026-09-28 11:33:29
258
原创 LlamaIndex 系列【36】结构化输出(Structured Outputs):入门案例
LlamaIndex 提供了多类组件来支持大模型生成结构化输出。默认的大模型封装类自带结构化输出能力,同时还提供了底层工具模块。
2026-09-28 11:31:07
301
原创 LlamaIndex 系列【35】节点后处理器(Node Postprocessor)
节点后处理器(NodePostprocessor)是 RAG 流程里检索之后、生成之前的一个处理环节:拿到检索器返回的 NodeWithScore 列表,对它做过滤、重排、改写元数据等二次加工,再把整理好的节点交给 LLM 生成答案。
2026-09-20 16:15:50
266
原创 LlamaIndex 系列【34】响应合成模式
TreeSummarize 换了个拓扑:把节点归并成满窗口的组,每组各自汇总,摘要再归并、再汇总,自底向上直到树根,根节点的输出就是最终回答。
2026-09-20 15:05:06
585
原创 LlamaIndex 系列【33】响应合成器(Response Synthesizer)
在 RAG 链路里,检索器拿到相关文档片段 (Node) 之后,把【用户问题 + 检索出来的多段文本】交给大模型,组织、合并、生成最终回答的这一整套逻辑,就叫响应合成。
2026-09-20 15:03:25
142
原创 LlamaIndex 系列【32】检索增强策略:自问自答(Self Ask)
Self-Ask 是一种多步推理 RAG/Agent 策略:大模型不直接回答用户原始问题,而是自己不断向自己提出子问题,逐个检索外部工具获取子问题答案,把问答记录保存到推理历史,直到信息足够,再输出最终答案。
2026-09-20 15:01:29
316
原创 LlamaIndex 系列【31】检索增强策略:命名实体识别(NER)
命名实体识别(Named Entity Recognition)用于识别查询语句内特定类型的信息并进行分类,以此实现更精准的检索与筛选策略。
2026-09-18 14:16:09
120
原创 LlamaIndex 系列【30】检索增强策略:子问题(Sub-Questions)
把一个复杂、多条件、多意图的原始大问题,拆解成多个独立、简单、单一维度的小问题,这些拆分后的小问题就是 Sub-Questions。
2026-09-18 11:41:34
278
原创 LlamaIndex 系列【29】检索增强策略:路由(Routing)机制
路由(Routing)是查询进来时的智能分发器,先判断这个问题属于哪类,再把它送到最合适的那个数据源/引擎去处理。它回答的问题是去哪问,而不是怎么问(那是查询重写)或拆成几个问(那是子问题)。
2026-09-18 11:25:33
338
原创 LlamaIndex 系列【28】检索增强策略:查询重写(Query Rewriting)
查询重写(Query Rewriting)是 RAG 检索流程中前置的核心优化策略,指在执行文档检索前,对用户原始输入的 Query 进行规范化加工、重构与拓展,生成更适配知识库、更贴合检索逻辑的新查询。
2026-09-18 10:01:09
267
原创 LlamaIndex 系列【27】检索增强策略:查询转换(Query Transformations)
RAG 增强策略不是一个精确的技术术语,而是一切能让 RAG 变好的手段的统称。
2026-09-18 10:00:34
298
原创 AgentScope Java 2.x 系列【44】 Agent 运行、管理与编排平台:AgentScope Service
AgentScope Service 作为面向智能体应用的运行、管理与编排平台,能够把独立 Agent 或是多 Agent 协作的业务流程,打包成可供外部调用、全程可追踪的标准化服务。
2026-09-15 15:55:25
480
原创 AgentScope Java 2.x 系列【43】v2.0.1 → v2.0.3 版本发布总览
AgentScope‑Java 2.0.0 于 7 月正式 GA,开启高密度迭代,专职团队按需快速发版,特性与缺陷修复同步推进,迭代闭环短,活跃度高;现阶段属于高速打磨期,底层能力持续演进。
2026-09-15 13:56:16
235
原创 LlamaIndex 系列【26】检索增强策略:重排序(Reranking)
在初始检索完成后,向量检索、关键词检索或混合检索会根据相似度快速返回一批候选文档,但这个原始排序仅依靠粗粒度向量/词匹配,容易出现语义误判、相关文档排名靠后的问题。
2026-09-11 10:04:13
88
原创 LlamaIndex 系列【25】检索增强策略:ColBERT(延迟交互检索)
ColBERT (Contextualized Late Interaction Over BERT) 即基于 BERT 的延迟交互检索模型,它是一种介于 Bi-Encoder 和 Cross-Encoder 之间的折衷方案,旨在平衡检索速度与匹配精度。
2026-09-11 10:02:24
191
原创 LlamaIndex 系列【24】检索增强策略:交叉编码器(Cross‑Encoder)
双编码器(Bi‑Encoder)就是有两个独立的编码器,分别把Query(查询) 和 Document Chunk(文档片段)各自独立编码成稠密向量(Embedding),再用余弦相似度计算两者匹配分数。
2026-09-10 19:48:11
366
原创 LlamaIndex 系列【23】检索增强策略:元数据过滤(Metadata Filtering)
元数据过滤( Metadata Filtering)是在检索时,先用节点上附加的结构化属性做硬性筛选,只保留符合条件的那部分节点,然后再在剩下的节点里做向量/BM25 打分排序。
2026-09-10 10:43:06
114
原创 LlamaIndex 系列【22】检索增强策略:混合检索(Hybrid Search)
混合检索( Hybrid Search )是最常用的增强技术方案,它通过「稀疏关键词检索 + 稠密向量检索」双路召回,再经过分数归一化与排名融合算法,同时兼顾精准命中与语义理解能力。
2026-09-10 09:56:47
205
原创 LlamaIndex 系列【21】语义检索(Semantic Search)
语义检索,是不局限于文字表面的词汇匹配,去理解用户查询和文档内在含义、意图,基于语义相似度完成内容召回的检索方式。
2026-09-05 10:20:53
361
原创 LlamaIndex 系列【20】关键词检索(Keyword Search):BM 25 算法
BM25 是生产环境标准关键词检索算法,ElasticSearch 默认的关键字检索算法是就是 BM25(Best Matching 25),从 5.x 版本开始取代了早期的 TF-IDF,成为默认的相关性评分算法。
2026-09-05 09:17:41
396
原创 LlamaIndex 系列【19】关键词检索(Keyword Search):关键词表索引
关键词表索引是离线构建「关键词到文本节点」的倒排字典,查询通过关键词精确匹配召回文档、按命中词数排序的轻量检索结构。
2026-09-04 10:46:41
350
原创 LlamaIndex 系列【18】关键词检索(Keyword Search):TF-IDF 算法
关键词检索(Keyword Search)属于信息检索 技术的基础方法之一,是一种通过输入关键字获取文档信息的查询方式。
2026-09-03 19:58:23
852
原创 LlamaIndex 系列【17】检索器(Retriever)
在 RAG 检索增强生成体系中,检索模块是整个链路的基石,其核心目标是从海量知识库中精准召回和用户问题相关的文档片段。
2026-09-03 17:23:28
219
原创 LlamaIndex 系列【16】查询引擎(Query Engine)
查询引擎接收自然语言问题,并返回内容详实的回答。它通常(但并非必须)依托一个或多个索引,借助检索器构建。你可以组合多个查询引擎,实现更复杂的能力。
2026-09-03 16:40:05
409
原创 LlamaIndex 系列【15】对话引擎(Chat Engine)
对话引擎是面向基于自有数据进行多轮对话的高层接口(支持来回多轮交互,而非单次问答)。你可以理解为接入了自有知识库的 ChatGPT。
2026-09-03 15:43:56
195
原创 LlamaIndex 系列【14】数据接入流水线(IngestionPipeline)
数据接入流水线(IngestionPipeline)是指 LlamaIndex 中专门用来把原始文档变成可检索 Node 的一站式处理链路。里面每一步处理单元叫做转换组件 (Transformations),例如:文档切分器、元数据提取器、Embedding 向量化器都属于转换组件。
2026-09-03 15:04:59
183
原创 LlamaIndex 系列【13】索引存储:SimpleIndexStore
LlamaIndex 提供高层接口,用于接入、构建索引以及查询外部数据。底层上,LlamaIndex 同时支持可替换的存储组件。
2026-09-03 14:57:44
276
原创 LlamaIndex 系列【12】向量存储索引(VectorStoreIndex)
VectorStoreIndex 是目前使用最广泛的索引类型。向量存储索引会将文档拆分为多个节点,接着为每个节点的文本生成向量嵌入(vector embeddings),供大模型后续查询使用。
2026-08-28 13:30:07
386
原创 LlamaIndex 系列【11】索引(Index)和索引构建(Indexing)
索引(Index)是面向查询场景、可快速匹配上下文信息的数据结构,是构成 LlamaIndex 检索增强生成(RAG)框架的核心基础。
2026-08-27 19:37:02
254
原创 LlamaIndex 系列【10】RAG 核心对象:Node(节点/分片)
Node 代表源 Document 的一个分片,可以是文本片段、图片或者其他形式。和 Document 类似,Node 同样携带元数据,以及和其他节点的关联信息。
2026-08-26 10:54:30
416
原创 LlamaIndex 系列【9】RAG 核心对象:Document(文档)
Document 是任意数据源的通用容器,例如 PDF 文件、API 返回结果、数据库查询得到的数据。文档既可以手动构造,也可以通过数据加载器自动生成。
2026-08-26 09:45:22
462
原创 LlamaIndex 系列【8】RAG Reader(读取器)快速入门
在上一篇文档中,我们了解了 RAG 的五大阶段,其中数据加载是整个流水线的入口。数据加载环节负责把外部多样化的原始资料,转换为 LlamaIndex 体系统一的 Document 文档对象,后续的文档切分、向量化、索引构建、检索问答全部依赖这一步的输出质量。
2026-08-25 14:53:07
252
原创 LlamaIndex 系列【7】RAG Data Loading(数据加载)
Loading(数据加载) 是 LLM 应用流水线的起点,负责对接各类异构数据源,将外部原始数据导入业务流程,支持文本文件、PDF 文档、网页内容、业务数据库、第三方 API 接口等多种数据来源。
2026-08-25 10:40:15
311
原创 LlamaIndex 系列【6】智能体开发:函数调用型智能体(FunctionAgent)
智能体配备一组工具,工具可以是任意自定义函数,也可以是完整的 LlamaIndex 查询引擎;智能体会挑选最合适的工具完成每一步操作。每一步执行完毕后,智能体会判断任务是否完成:若已完成,则向用户返回结果;若未完成,则回到流程起点,继续执行下一步。
2026-08-24 23:25:11
327
原创 LlamaIndex 系列【5】智能体开发:大语言模型接入与基础调用
LlamaIndex 为大模型应用开发提供了从基础模型调用、RAG 知识库搭建、智能体开发到高阶工作流定制、落地优化的全链路解决方案,模块化、标准化的开发模式,极大降低了企业级 AI 应用的开发门槛。
2026-08-22 22:29:33
321
原创 LlamaIndex 系列【4】入门案例(阿里云百炼适配)
LlamaIndex 的顶层目标是构建各类上下文增强型大模型应用,涵盖问答、文档提取、智能体、事件驱动工作流等场景。理解这套顶层设计,才能跳出 Demo,设计出可落地的生产级应用。
2026-08-21 20:26:20
182
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅