自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

记录知识、锤炼自我

Spring、Spring Boot、Spring Cloud、DevOps、Redis、Mysql、微服务、云原生、大数据.....你想要的这里都有

  • 博客(1115)
  • 资源 (2)
  • 收藏
  • 关注

原创 LlamaIndex 系列【41】数据连接器:LlamaParse、LiteParse

数据连接器(也称为Reader读取器)用于从不同数据源、不同数据格式中读取数据,并将其转换为统一的Document文档对象(包含文本与基础元数据)。

2026-09-29 10:23:13 199

原创 LlamaIndex 系列【40】存储组件:文档存储(Document Stores)

默认情况下,SimpleDocumentStore 在内存中存储Node对象。你可以调用docstore.persist()将数据持久化到磁盘;也可以通过SimpleDocumentStore.from_persist_path(...)从磁盘加载数据。

2026-09-28 17:00:47 189

原创 LlamaIndex 系列【39】存储组件:对话存储(Chat Stores)

对话存储提供统一接口来存放对话历史。对话历史与其他存储格式不同:消息顺序对完整会话至关重要

2026-09-28 15:42:37 64

原创 LlamaIndex 系列【38】存储组件:向量存储(Vector stores)

向量存储用于存放已摄取文档分片的嵌入向量(部分向量存储也会直接保存文档分片本身)。

2026-09-28 15:19:06 180

原创 LlamaIndex 系列【37】结构化输出(Structured Outputs):进阶案例

structured_predict 是 LLM 基类的格式化问答函数,给一个 Pydantic 类和一个提示词模板,返回填充好的 Pydantic 实例。

2026-09-28 11:33:29 258

原创 LlamaIndex 系列【36】结构化输出(Structured Outputs):入门案例

LlamaIndex 提供了多类组件来支持大模型生成结构化输出。默认的大模型封装类自带结构化输出能力,同时还提供了底层工具模块。

2026-09-28 11:31:07 301

原创 LlamaIndex 系列【35】节点后处理器(Node Postprocessor)

节点后处理器(NodePostprocessor)是 RAG 流程里检索之后、生成之前的一个处理环节:拿到检索器返回的 NodeWithScore 列表,对它做过滤、重排、改写元数据等二次加工,再把整理好的节点交给 LLM 生成答案。

2026-09-20 16:15:50 266

原创 LlamaIndex 系列【34】响应合成模式

TreeSummarize 换了个拓扑:把节点归并成满窗口的组,每组各自汇总,摘要再归并、再汇总,自底向上直到树根,根节点的输出就是最终回答。

2026-09-20 15:05:06 585

原创 LlamaIndex 系列【33】响应合成器(Response Synthesizer)

在 RAG 链路里,检索器拿到相关文档片段 (Node) 之后,把【用户问题 + 检索出来的多段文本】交给大模型,组织、合并、生成最终回答的这一整套逻辑,就叫响应合成。

2026-09-20 15:03:25 142

原创 LlamaIndex 系列【32】检索增强策略:自问自答(Self Ask)

Self-Ask 是一种多步推理 RAG/Agent 策略:大模型不直接回答用户原始问题,而是自己不断向自己提出子问题,逐个检索外部工具获取子问题答案,把问答记录保存到推理历史,直到信息足够,再输出最终答案。

2026-09-20 15:01:29 316

原创 LlamaIndex 系列【31】检索增强策略:命名实体识别(NER)

命名实体识别(Named Entity Recognition)用于识别查询语句内特定类型的信息并进行分类,以此实现更精准的检索与筛选策略。

2026-09-18 14:16:09 120

原创 LlamaIndex 系列【30】检索增强策略:子问题(Sub-Questions)

把一个复杂、多条件、多意图的原始大问题,拆解成多个独立、简单、单一维度的小问题,这些拆分后的小问题就是 Sub-Questions。

2026-09-18 11:41:34 278

原创 LlamaIndex 系列【29】检索增强策略:路由(Routing)机制

路由(Routing)是查询进来时的智能分发器,先判断这个问题属于哪类,再把它送到最合适的那个数据源/引擎去处理。它回答的问题是去哪问,而不是怎么问(那是查询重写)或拆成几个问(那是子问题)。

2026-09-18 11:25:33 338

原创 LlamaIndex 系列【28】检索增强策略:查询重写(Query Rewriting)

查询重写(Query Rewriting)是 RAG 检索流程中前置的核心优化策略,指在执行文档检索前,对用户原始输入的 Query 进行规范化加工、重构与拓展,生成更适配知识库、更贴合检索逻辑的新查询。

2026-09-18 10:01:09 267

原创 LlamaIndex 系列【27】检索增强策略:查询转换(Query Transformations)

RAG 增强策略不是一个精确的技术术语,而是一切能让 RAG 变好的手段的统称。

2026-09-18 10:00:34 298

原创 AgentScope Java 2.x 系列【44】 Agent 运行、管理与编排平台:AgentScope Service

AgentScope Service 作为面向智能体应用的运行、管理与编排平台,能够把独立 Agent 或是多 Agent 协作的业务流程,打包成可供外部调用、全程可追踪的标准化服务。

2026-09-15 15:55:25 480

原创 AgentScope Java 2.x 系列【43】v2.0.1 → v2.0.3 版本发布总览

AgentScope‑Java 2.0.0 于 7 月正式 GA,开启高密度迭代,专职团队按需快速发版,特性与缺陷修复同步推进,迭代闭环短,活跃度高;现阶段属于高速打磨期,底层能力持续演进。

2026-09-15 13:56:16 235

原创 LlamaIndex 系列【26】检索增强策略:重排序(Reranking)

在初始检索完成后,向量检索、关键词检索或混合检索会根据相似度快速返回一批候选文档,但这个原始排序仅依靠粗粒度向量/词匹配,容易出现语义误判、相关文档排名靠后的问题。

2026-09-11 10:04:13 88

原创 LlamaIndex 系列【25】检索增强策略:ColBERT(延迟交互检索)

ColBERT (Contextualized Late Interaction Over BERT) 即基于 BERT 的延迟交互检索模型,它是一种介于 Bi-Encoder 和 Cross-Encoder 之间的折衷方案,旨在平衡检索速度与匹配精度。

2026-09-11 10:02:24 191

原创 LlamaIndex 系列【24】检索增强策略:交叉编码器(Cross‑Encoder)

双编码器(Bi‑Encoder)就是有两个独立的编码器,分别把Query(查询) 和 Document Chunk(文档片段)各自独立编码成稠密向量(Embedding),再用余弦相似度计算两者匹配分数。

2026-09-10 19:48:11 366

原创 LlamaIndex 系列【23】检索增强策略:元数据过滤(Metadata Filtering)

元数据过滤( Metadata Filtering)是在检索时,先用节点上附加的结构化属性做硬性筛选,只保留符合条件的那部分节点,然后再在剩下的节点里做向量/BM25 打分排序。

2026-09-10 10:43:06 114

原创 LlamaIndex 系列【22】检索增强策略:混合检索(Hybrid Search)

混合检索( Hybrid Search )是最常用的增强技术方案,它通过「稀疏关键词检索 + 稠密向量检索」双路召回,再经过分数归一化与排名融合算法,同时兼顾精准命中与语义理解能力。

2026-09-10 09:56:47 205

原创 LlamaIndex 系列【21】语义检索(Semantic Search)

语义检索,是不局限于文字表面的词汇匹配,去理解用户查询和文档内在含义、意图,基于语义相似度完成内容召回的检索方式。

2026-09-05 10:20:53 361

原创 LlamaIndex 系列【20】关键词检索(Keyword Search):BM 25 算法

BM25 是生产环境标准关键词检索算法,ElasticSearch 默认的关键字检索算法是就是 ‌BM25‌(Best Matching 25),从 5.x 版本开始取代了早期的 TF-IDF,成为默认的相关性评分算法。‌‌

2026-09-05 09:17:41 396

原创 LlamaIndex 系列【19】关键词检索(Keyword Search):关键词表索引

关键词表索引是离线构建「关键词到文本节点」的倒排字典,查询通过关键词精确匹配召回文档、按命中词数排序的轻量检索结构。

2026-09-04 10:46:41 350

原创 LlamaIndex 系列【18】关键词检索(Keyword Search):TF-IDF 算法

关键词检索(Keyword Search)属于信息检索 技术的基础方法之一,是一种通过输入关键字获取文档信息的查询方式。

2026-09-03 19:58:23 852

原创 LlamaIndex 系列【17】检索器(Retriever)

在 RAG 检索增强生成体系中,检索模块是整个链路的基石,其核心目标是从海量知识库中精准召回和用户问题相关的文档片段。

2026-09-03 17:23:28 219

原创 LlamaIndex 系列【16】查询引擎(Query Engine)

查询引擎接收自然语言问题,并返回内容详实的回答。它通常(但并非必须)依托一个或多个索引,借助检索器构建。你可以组合多个查询引擎,实现更复杂的能力。

2026-09-03 16:40:05 409

原创 LlamaIndex 系列【15】对话引擎(Chat Engine)

对话引擎是面向基于自有数据进行多轮对话的高层接口(支持来回多轮交互,而非单次问答)。你可以理解为接入了自有知识库的 ChatGPT。

2026-09-03 15:43:56 195

原创 LlamaIndex 系列【14】数据接入流水线(IngestionPipeline)

数据接入流水线(IngestionPipeline)是指 LlamaIndex 中专门用来把原始文档变成可检索 Node 的一站式处理链路。里面每一步处理单元叫做转换组件 (Transformations),例如:文档切分器、元数据提取器、Embedding 向量化器都属于转换组件。

2026-09-03 15:04:59 183

原创 LlamaIndex 系列【13】索引存储:SimpleIndexStore

LlamaIndex 提供高层接口,用于接入、构建索引以及查询外部数据。底层上,LlamaIndex 同时支持可替换的存储组件。

2026-09-03 14:57:44 276

原创 LlamaIndex 系列【12】向量存储索引(VectorStoreIndex)

VectorStoreIndex 是目前使用最广泛的索引类型。向量存储索引会将文档拆分为多个节点,接着为每个节点的文本生成向量嵌入(vector embeddings),供大模型后续查询使用。

2026-08-28 13:30:07 386

原创 LlamaIndex 系列【11】索引(Index)和索引构建(Indexing)

索引(Index)是面向查询场景、可快速匹配上下文信息的数据结构,是构成 LlamaIndex 检索增强生成(RAG)框架的核心基础。

2026-08-27 19:37:02 254

原创 LlamaIndex 系列【10】RAG 核心对象:Node(节点/分片)

Node 代表源 Document 的一个分片,可以是文本片段、图片或者其他形式。和 Document 类似,Node 同样携带元数据,以及和其他节点的关联信息。

2026-08-26 10:54:30 416

原创 LlamaIndex 系列【9】RAG 核心对象:Document(文档)

Document 是任意数据源的通用容器,例如 PDF 文件、API 返回结果、数据库查询得到的数据。文档既可以手动构造,也可以通过数据加载器自动生成。

2026-08-26 09:45:22 462

原创 LlamaIndex 系列【8】RAG Reader(读取器)快速入门

在上一篇文档中,我们了解了 RAG 的五大阶段,其中数据加载是整个流水线的入口。数据加载环节负责把外部多样化的原始资料,转换为 LlamaIndex 体系统一的 Document 文档对象,后续的文档切分、向量化、索引构建、检索问答全部依赖这一步的输出质量。

2026-08-25 14:53:07 252

原创 LlamaIndex 系列【7】RAG Data Loading(数据加载)

Loading(数据加载) 是 LLM 应用流水线的起点,负责对接各类异构数据源,将外部原始数据导入业务流程,支持文本文件、PDF 文档、网页内容、业务数据库、第三方 API 接口等多种数据来源。

2026-08-25 10:40:15 311

原创 LlamaIndex 系列【6】智能体开发:函数调用型智能体(FunctionAgent)

智能体配备一组工具,工具可以是任意自定义函数,也可以是完整的 LlamaIndex 查询引擎;智能体会挑选最合适的工具完成每一步操作。每一步执行完毕后,智能体会判断任务是否完成:若已完成,则向用户返回结果;若未完成,则回到流程起点,继续执行下一步。

2026-08-24 23:25:11 327

原创 LlamaIndex 系列【5】智能体开发:大语言模型接入与基础调用

LlamaIndex 为大模型应用开发提供了从基础模型调用、RAG 知识库搭建、智能体开发到高阶工作流定制、落地优化的全链路解决方案,模块化、标准化的开发模式,极大降低了企业级 AI 应用的开发门槛。

2026-08-22 22:29:33 321

原创 LlamaIndex 系列【4】入门案例(阿里云百炼适配)

LlamaIndex 的顶层目标是构建各类上下文增强型大模型应用,涵盖问答、文档提取、智能体、事件驱动工作流等场景。理解这套顶层设计,才能跳出 Demo,设计出可落地的生产级应用。

2026-08-21 20:26:20 182

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除