3.“茴香豆“:零代码搭建你的 RAG 智能助理

Wangy_Pustar

已于 2024-06-06 10:12:15 修改

阅读量714

点赞数 19

文章标签：语言模型人工智能

于 2024-06-04 12:11:04 首次发布

本文链接：https://blog.csdn.net/asdblf/article/details/139437962

版权

参考视频：茴香豆：搭建你的 RAG 智能助理_哔哩哔哩_bilibili

参考项目：Tutorial/huixiangdou/readme.md at camp2 · InternLM/Tutorial · GitHub

3.0 RAG介绍

（1）定义

RAG就像搜索引擎，用户输入内容就像提示，在外部知识库搜寻内容，通过检索和生成提高LLM性能。

解决大模型胡说八道、知识过时和缺乏推理逻辑的问题。RAG因为没有训练过程，借助外部知识库提供更准确的回答，成本低。

（2）RAG核心：索引、检索、生成

索引：编码外部知识库

检索：编码用户输入的问题，在库内找到最相关的chunk返回

生成：提示=问题+chunk，送给大模型，等待生成回答

Vector-DB：存储（向量表示）、高效检索（余弦、点乘）、

（3）RAG优化思路：

数据库方面：

嵌入式优化：

索引优化：chunk大小、索引结构

提示方面：

查询优化：对提示进行改写，使其更能生成回答

上下文优化：去除冗余提高效率

检索方面：

迭代检索：多次检索知识，提高知识质量

递归检索：提高检索深度、细化检索过程

自适应检索：自主决定检索内容和时机

大模型微调

（4）RAG和微调的区别

	RAG	微调
模型	不改变模型参数，外部知识库实时更新	改变特定模型参数、特定数据训练
优点	时效性、多样化高、解决长尾问题	特定任务
应用	小知识库、开放领域、实时新闻	专业化模型
局限	依赖外部知识库的质量和范围、性能基座大模型	需要大量标注数据、过拟合泛化下降、时效性低

（5）LLM优化

	微调	提示工程	RAG
对外部知识的需求	低	低	高
特定任务	高	低	低

（6）RAG评价

检索和生成单独评价指标、框架

3.1 RAG环境准备

（1）开发机、环境：

创建开发机，30%A100，打开。创建并激活conda环境InternLM2_Huixiangdou，安装包

studio-conda -o internlm-base -t InternLM2_Huixiangdou
conda activate InternLM2_Huixiangdou

pip install protobuf==4.25.3 accelerate==0.28.0 aiohttp==3.9.3 auto-gptq==0.7.1 bcembedding==0.1.3 beautifulsoup4==4.8.2 einops==0.7.0 faiss-gpu==1.7.2 langchain==0.1.14 loguru==0.7.2 lxml_html_clean==0.1.0 openai==1.16.1 openpyxl==3.1.2 pandas==2.2.1 pydantic==2.6.4 pymupdf==1.24.1 python-docx==1.1.0 pytoml==0.1.21 readability-lxml==0.8.1 redis==5.0.3 requests==2.31.0 scikit-learn==1.4.1.post1 sentence_transformers==2.2.2 textract==1.6.5 tiktoken==0.6.0 transformers==4.39.3 transformers_stream_generator==0.0.5 unstructured==0.11.2

（2）下载基础文件：

从开发机share文件夹中复制茴香豆所需模型文件、下载茴香豆

# 创建模型文件夹
cd /root && mkdir models

# 复制BCE模型
ln -s /root/share/new_models/maidalun1020/bce-embedding-base_v1 /root/models/bce-embedding-base_v1
ln -s /root/share/new_models/maidalun1020/bce-reranker-base_v1 /root/models/bce-reranker-base_v1

# 复制大模型参数（下面的模型，根据作业进度和任务进行**选择一个**就行）
ln -s /root/share/new_models/Shanghai_AI_Laboratory/internlm2-chat-7b /root/models/internlm2-chat-7b


cd /root
# 克隆代码仓库
git clone https://github.com/internlm/huixiangdou && cd huixiangdou
git checkout 447c6f7e68a1657fce1c4f7c740ea1700bde0440

3.2 茴香豆搭建

（1）修改配置文件：

用已下载模型的路径替换 /root/huixiangdou/config.ini 文件中的默认模型：

# 向量数据库和词嵌入的模型
sed -i '6s#.*#embedding_model_path = "/root/models/bce-embedding-base_v1"#' /root/huixiangdou/config.ini

# 检索的重排序模型
sed -i '7s#.*#reranker_model_path = "/root/models/bce-reranker-base_v1"#' /root/huixiangdou/config.ini

# 本次选用的大模型
sed -i '29s#.*#local_llm_path = "/root/models/internlm2-chat-7b"#' /root/huixiangdou/config.ini

修改好的配置文件应该如下图所示：

（2）创建知识库

下载huixiangdou语料知识

cd /root/huixiangdou && mkdir repodir
git clone https://github.com/internlm/huixiangdou --depth=1 repodir/huixiangdou

除了语料知识的向量数据库，茴香豆建立接受和拒答两个向量数据库，用来在检索的过程中更加精确的判断提问的相关性，这两个数据库的来源分别是：

接受问题列表，希望茴香豆助手回答的示例问题
- 存储在 huixiangdou/resource/good_questions.json 中

运行下面的命令，增加茴香豆相关的问题到接受问题示例中：

cd /root/huixiangdou
mv resource/good_questions.json resource/good_questions_bk.json

echo '[
    "mmpose中怎么调用mmyolo接口",
    "mmpose实现姿态估计后怎么实现行为识别",
    "mmpose执行提取关键点命令不是分为两步吗，一步是目标检测，另一步是关键点提取，我现在目标检测这部分的代码是demo/topdown_demo_with_mmdet.py demo/mmdetection_cfg/faster_rcnn_r50_fpn_coco.py checkpoints/faster_rcnn_r50_fpn_1x_coco_20200130-047c8118.pth   现在我想把这个mmdet的checkpoints换位yolo的，那么应该怎么操作",
    "在mmdetection中，如何同时加载两个数据集，两个dataloader",
    "如何将mmdetection2.28.2的retinanet配置文件改为单尺度的呢？",
    "1.MMPose_Tutorial.ipynb、inferencer_demo.py、image_demo.py、bottomup_demo.py、body3d_pose_lifter_demo.py这几个文件和topdown_demo_with_mmdet.py的区别是什么，\n2.我如果要使用mmdet是不是就只能使用topdown_demo_with_mmdet.py文件，",
    "mmpose 测试 map 一直是 0 怎么办？",
    "如何使用mmpose检测人体关键点？",
    "我使用的数据集是labelme标注的，我想知道mmpose的数据集都是什么样式的，全都是单目标的数据集标注，还是里边也有多目标然后进行标注",
    "如何生成openmmpose的c++推理脚本",
    "mmpose",
    "mmpose的目标检测阶段调用的模型，一定要是demo文件夹下的文件吗，有没有其他路径下的文件",
    "mmpose可以实现行为识别吗，如果要实现的话应该怎么做",
    "我在mmyolo的v0.6.0 (15/8/2023)更新日志里看到了他新增了支持基于 MMPose 的 YOLOX-Pose，我现在是不是只需要在mmpose/project/yolox-Pose内做出一些设置就可以，换掉demo/mmdetection_cfg/faster_rcnn_r50_fpn_coco.py 改用mmyolo来进行目标检测了",
    "mac m1从源码安装的mmpose是x86_64的",
    "想请教一下mmpose有没有提供可以读取外接摄像头，做3d姿态并达到实时的项目呀？",
    "huixiangdou 是什么？",
    "使用科研仪器需要注意什么？",
    "huixiangdou 是什么？",
    "茴香豆 是什么？",
    "茴香豆 能部署到微信吗？",
    "茴香豆 怎么应用到飞书",
    "茴香豆 能部署到微信群吗？",
    "茴香豆 怎么应用到飞书群",
    "huixiangdou 能部署到微信吗？",
    "huixiangdou 怎么应用到飞书",
    "huixiangdou 能部署到微信群吗？",
    "huixiangdou 怎么应用到飞书群",
    "huixiangdou",
    "茴香豆",
    "茴香豆 有哪些应用场景",
    "huixiangdou 有什么用",
    "huixiangdou 的优势有哪些？",
    "茴香豆 已经应用的场景",
    "huixiangdou 已经应用的场景",
    "huixiangdou 怎么安装",
    "茴香豆 怎么安装",
    "茴香豆 最新版本是什么",
    "茴香豆 支持哪些大模型",
    "茴香豆 支持哪些通讯软件",
    "config.ini 文件怎么配置",
    "remote_llm_model 可以填哪些模型?"
]' > /root/huixiangdou/resource/good_questions.json

再创建一个测试用的问询列表，用来测试拒答流程是否起效：

cd /root/huixiangdou

echo '[
"huixiangdou 是什么？",
"你好，介绍下自己"
]' > ./test_queries.json

创建 RAG 检索过程中使用的向量数据库

# 创建向量数据库存储目录
cd /root/huixiangdou && mkdir workdir 

# 分别向量化知识语料、接受问题和拒绝问题中后保存到 workdir
python3 -m huixiangdou.service.feature_store --sample ./test_queries.json

测试一下效果：

# 填入问题
sed -i '74s/.*/    queries = ["huixiangdou 是什么？", "茴香豆怎么部署到微信群", "今天天气怎么样？"]/' /root/huixiangdou/huixiangdou/main.py

# 运行茴香豆
cd /root/huixiangdou/
python3 -m huixiangdou.main --standalone

Wangy_Pustar

关注

19
点赞
踩
9

收藏

觉得还不错? 一键收藏
0
评论
3.“茴香豆“:零代码搭建你的 RAG 智能助理

RAG就像搜索引擎，用户输入内容就像提示，在外部知识库搜寻内容，通过检索和生成提高LLM性能。大模型胡说八道、知识过时和缺乏推理逻辑的问题。RAG因为没有训练过程，借助外部知识库提供更准确的回答，成本低。
复制链接

扫一扫