安逸 i
每天一点AI:资料、笔记、工具、趋势,一起进步。
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
【生产级 RAG 系统】开篇:RAG 架构演进与核心挑战——从基础检索到生产级系统的跃迁之路!
检索增强生成(RAG)是构建企业级 AI 应用的核心技术。本系列将带你从基础原理到生产实践,深入讲解多路召回、混合检索、重排序等关键技术,打造高性能、高可用的生产级 RAG 系统。原创 2026-03-14 10:24:58 · 312 阅读 · 0 评论
-
【生产级 RAG 系统】实战案例:完整 RAG 系统从 0 到 1——端到端项目实现与部署!
本系列最后一篇,将前面 7 篇文章的知识融会贯通,带你从零构建一个完整的生产级 RAG 系统,包含架构设计、代码实现、Docker/Kubernetes 部署、监控告警和性能测试。原创 2026-03-14 11:37:14 · 99 阅读 · 0 评论 -
【生产级 RAG 系统】生产优化:缓存、预计算、流式更新——打造高性能高可用的 RAG 系统
生产级 RAG 系统不仅需要功能完善,更需要高性能、高可用、低成本。本文深入讲解查询缓存、索引预计算、流式更新、性能监控、成本控制、高可用设计等关键技术,助你打造企业级 RAG 系统。原创 2026-03-14 11:33:15 · 177 阅读 · 0 评论 -
【生产级 RAG 系统】混合检索:稀疏 + 密集 + 学习排序——融合多种检索策略的终极方案!
在生产级 RAG 系统中,单一检索策略往往难以满足复杂场景的召回需求。混合检索通过融合稀疏检索(BM25/TF-IDF)和密集检索(向量相似度),结合学习排序(LTR)技术,实现优势互补,显著提升检索质量。本文将深入讲解混合检索的架构设计、算法原理和实战实现。原创 2026-03-14 11:17:16 · 133 阅读 · 0 评论 -
【生产级 RAG 系统】重排序:Cross-Encoder、LLM Rerank——提升检索质量的精排技术!
在 RAG 系统中,粗排(向量检索)负责快速召回候选文档,而精排(重排序)则决定了最终进入 LLM 上下文的文档质量。本文深入讲解 Cross-Encoder、LLM Rerank 等重排序技术,帮助你构建高质量的生产级 RAG 系统。原创 2026-03-14 11:15:16 · 229 阅读 · 0 评论 -
【生产级 RAG 系统】多路召回:向量 + 关键词 + 图检索——融合多种检索策略实现全面召回!
在 RAG 系统中,单一检索方式难以覆盖所有查询场景。多路召回通过融合向量检索、关键词检索和图检索等多种策略,实现互补优势,显著提升召回率和准确性。本文将深入讲解多路召回架构设计与实战实现。原创 2026-03-14 11:11:05 · 211 阅读 · 0 评论 -
【生产级 RAG 系统】向量检索:HNSW、IVF、量化技术——高性能近似最近邻搜索实战!
向量检索是 RAG 系统的性能核心。本章深入讲解 HNSW、IVF 等主流索引算法,乘积量化与标量量化技术,相似度度量方法,以及 Milvus 生产环境实战配置,助你构建毫秒级响应的向量检索服务。原创 2026-03-14 11:05:49 · 111 阅读 · 0 评论 -
【生产级 RAG 系统】文档处理:解析、分块、向量化策略——构建高质量知识库的第一步!
文档处理是 RAG 系统的基础。本章将深入讲解 PDF/Office 解析、智能分块策略、Embedding 模型选型与优化,帮你构建高质量的知识库。原创 2026-03-14 11:03:28 · 129 阅读 · 0 评论
分享