一份 RAG 技术的全面指南：15 种高级 RAG 技术 ——从预检索到生成

AIGC莹子

于 2024-08-26 11:14:40 发布

阅读量529

点赞数 14

文章标签： prompt 职场和发展人工智能 AIGC 语言模型

本文链接：https://blog.csdn.net/z551646/article/details/141559110

版权

周末推荐，来自willowtree的一份非常全面的RAG技术指南，这份指南分享了15 种高级 RAG 技术 ——从预检索到生成，非常值得一读：

这里我们做一个简要介绍

什么是检索增强生成RAG？

检索增强生成（RAG）是指对大型语言模型输出进行优化，使其能够在生成响应之前引用训练数据来源之外的权威知识库。大型语言模型（LLM）用海量数据进行训练，使用数十亿个参数为回答问题、翻译语言和完成句子等任务生成原始输出。在 LLM 本就强大的功能基础上，RAG 将其扩展为能访问特定领域或组织的内部知识库，所有这些都无需重新训练模型。这是一种经济高效地改进 LLM 输出的方法，让它在各种情境下都能保持相关性、准确性和实用性。

为什么检索增强生成很重要？

LLM 是一项关键的人工智能（AI）技术，为智能聊天机器人和其他自然语言处理（NLP）应用程序提供支持。目标是通过交叉引用权威知识来源，创建能够在各种环境中回答用户问题的机器人。不幸的是，LLM 技术的本质在 LLM 响应中引入了不可预测性。此外，LLM 训练数据是静态的，并引入了其所掌握知识的截止日期。

LLM 面临的已知挑战包括：

在没有答案的情况下提供虚假信息
当用户需要特定的当前响应时，提供过时或通用的信息
从非权威来源创建响应
由于术语混淆，不同的培训来源使用相同的术语来谈论不同的事情，因此会产生不准确的响应

你可以将大型语言模型看作是一个过于热情的新员工，他拒绝随时了解时事，但总是会绝对自信地回答每一个问题。不幸的是，这种态度会对用户的信任产生负面影响，这是你不希望聊天机器人效仿的！

RAG 是解决其中一些挑战的一种方法。它会重定向 LLM，从权威的、预先确定的知识来源中检索相关信息。组织可以更好地控制生成的文本输出，并且用户可以深入了解 LLM 如何生成响应。

本文探讨了 15 种高级 RAG（检索增强生成）技术，旨在提升生成式 AI 系统的输出质量和整体性能稳健性。这些技术涵盖了从预检索到最终文本生成的各个阶段，为 AI 系统的精细化调整提供了丰富的选项

1. 预检索和数据索引技术

提高信息密度： 利用 LLM 对原始数据进行处理、清理和标记，剔除无关信息，提高信息密度，降低 LLM token 使用量和成本，并提升检索准确性。文中以使用 GPT-4 提取网页关键信息为例进行了说明，并强调了信息损失的风险和缓解策略。

应用分层索引检索： 利用 LLM 生成文档摘要，创建多层检索系统，先通过摘要筛选相关文档，再进行更精细的检索，提高检索效率

利用假设问题索引提升检索对称性： 使用 LLM 生成文档对应的假设问题和答案，并将问题作为检索单元，以解决查询与文档之间语义不对称的问题，提高检索准确性。

使用 LLM 对数据索引中的信息进行去重： 通过聚类和 LLM 的信息提取能力，将数据索引中的信息去重，减少冗余，优化 LLM 的上下文窗口。

测试和优化分块策略： 根据 embedding 模型、内容性质、查询复杂度、LLM 能力、数据量等因素，对分块策略进行 A/B 测试和优化，找到最佳分块大小和重叠率

2. 检索技术

利用 LLM 优化搜索查询： 利用 LLM 的理解能力和对搜索引擎规则的掌握，将用户查询转化为更有效的搜索查询，提升检索效率和结果质量。文中分别给出了简单搜索查询和对话式 AI 系统查询优化的示例

利用假设文档嵌入解决查询-文档不对称问题（HyDE）： 利用 LLM 根据用户查询生成假设文档或文档片段，并将其用于语义搜索，解决查询-文档不对称问题，提高检索准确性

实施查询路由或 RAG 决策器模式： 使用 LLM 将查询路由到适当的数据库，或判断是否需要进行 RAG 检索，以降低成本和提升效率

3. 检索后技术

使用重排序优化搜索结果： 使用重排序模型优化搜索结果的优先级，将最相关的文档置于最前，提升 LLM 回答的准确性

使用上下文提示压缩优化搜索结果： 利用 LLM 过滤、重新格式化或压缩检索到的信息，使之更适合 LLM 生成最终回复

使用纠正性 RAG 对检索到的文档进行评分和过滤： 使用训练好的模型对检索结果进行评估，过滤掉不正确或不相关的文档，提升 LLM 回答的准确性

4. 生成技术

优化提示和上下文窗口大小： 对生成提示进行优化，并通过实验确定最佳的上下文窗口大小，提升 LLM 回答的质量

使用思维链提示消除噪声： 使用思维链提示引导 LLM 进行推理，增强其在存在噪声或无关上下文时的稳健性

使用 Self-RAG 使系统具备自我反思能力： 通过微调，使 LLM 能够在生成过程中输出特殊的反射标记（检索或批判标记），从而评估检索结果的相关性和生成结果的质量，并进行优化

通过微调忽略不相关上下文： 对 LLM 进行微调，使其能够忽略不相关的上下文，提升其在 RAG 任务中的性能

使用自然语言推理使 LLM 对不相关上下文更加稳健： 使用自然语言推理模型过滤掉不相关的上下文，提升 LLM 回答的准确性

其他考虑因素

输入和输出防护： 对 RAG 系统的输入和输出进行防护，防止出现越狱或恶意攻击，尤其是在金融服务和医疗保健等高监管行业

评估 RAG 系统： 建立可扩展的自动化评估方法，以监控 RAG 系统的性能，确保其质量和准确性

幻觉率： 关注 AI 幻觉问题，并采取措施进行检测、测量和缓解

其他潜在改进

• 微调 embedding 模型
• 使用知识图谱
• 使用长上下文 LLM

总而言之，高级 RAG 技术为提升生成式 AI 系统的性能提供了丰富的工具和方法。通过合理地选择和应用这些技术，可以显著提高信息密度、检索准确性和用户回复质量。

如何学习大模型 AI ？

由于新岗位的生产效率，要优于被取代岗位的生产效率，所以实际上整个社会的生产效率是提升的。

但是具体到个人，只能说是：

“最先掌握AI的人，将会比较晚掌握AI的人有竞争优势”。

这句话，放在计算机、互联网、移动互联网的开局时期，都是一样的道理。

我在一线互联网企业工作十余年里，指导过不少同行后辈。帮助很多人得到了学习和成长。

我意识到有很多经验和知识值得分享给大家，也可以通过我们的能力和经验解答大家在人工智能学习中的很多困惑，所以在工作繁忙的情况下还是坚持各种整理和分享。但苦于知识传播途径有限，很多互联网行业朋友无法获得正确的资料得到学习提升，故此将并将重要的AI大模型资料包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。

😝有需要的小伙伴，可以Vx扫描下方二维码免费领取🆓

👉1.大模型入门学习思维导图👈

要学习一门新的技术，作为新手一定要先学习成长路线图，方向不对，努力白费。

对于从来没有接触过AI大模型的同学，我们帮你准备了详细的学习成长路线图&学习规划。可以说是最科学最系统的学习路线，大家跟着这个大的方向学习准没问题。（全套教程文末领取哈）
在这里插入图片描述

👉2.AGI大模型配套视频👈

很多朋友都不喜欢晦涩的文字，我也为大家准备了视频教程，每个章节都是当前板块的精华浓缩。

在这里插入图片描述

👉3.大模型实际应用报告合集👈

这套包含640份报告的合集，涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师，还是对AI大模型感兴趣的爱好者，这套报告合集都将为您提供宝贵的信息和启示。（全套教程文末领取哈）

在这里插入图片描述

👉4.大模型落地应用案例PPT👈

光学理论是没用的，要学会跟着一起做，要动手实操，才能将自己的所学运用到实际当中去，这时候可以搞点实战案例来学习。（全套教程文末领取哈）

在这里插入图片描述

👉5.大模型经典学习电子书👈

随着人工智能技术的飞速发展，AI大模型已经成为了当今科技领域的一大热点。这些大型预训练模型，如GPT-3、BERT、XLNet等，以其强大的语言理解和生成能力，正在改变我们对人工智能的认识。那以下这些PDF籍就是非常不错的学习资源。

在这里插入图片描述

👉6.大模型面试题&答案👈

截至目前大模型已经超过200个，在大模型纵横的时代，不仅大模型技术越来越卷，就连大模型相关的岗位和面试也开始越来越卷了。为了让大家更容易上车大模型算法赛道，我总结了大模型常考的面试题。

在这里插入图片描述

这份完整版的大模型 AI 学习资料已经上传CSDN，朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【`保证100%免费`】

😝有需要的小伙伴，可以Vx扫描下方二维码免费领取🆓

AIGC莹子

关注

14
点赞
踩
11

收藏

觉得还不错? 一键收藏
0
评论
一份 RAG 技术的全面指南：15 种高级 RAG 技术 ——从预检索到生成

检索增强生成（RAG）是指对大型语言模型输出进行优化，使其能够在生成响应之前引用训练数据来源之外的权威知识库。大型语言模型（LLM）用海量数据进行训练，使用数十亿个参数为回答问题、翻译语言和完成句子等任务生成原始输出。在 LLM 本就强大的功能基础上，RAG 将其扩展为能访问特定领域或组织的内部知识库，所有这些都无需重新训练模型。这是一种经济高效地改进 LLM 输出的方法，让它在各种情境下都能保持相关性、准确性和实用性。
复制链接

扫一扫