解决大模型四大缺陷，零一万物自研全导航图向量数据库！-CSDN博客

出品丨AI 科技大本营（ID：rgznai100）

北京时间 3 月 11 日，龙抬头之日，零一万物宣布成功研发出基于全导航图的新型向量数据库 “笛卡尔（Descartes）”，已包揽权威榜单 ANN-Benchmarks 6 项数据集评测第一名。

在国际权威评测平台 ANN-Benchmarks 离线测试中，零一万物笛卡尔（Descartes）向量数据库登顶 6 份数据集评测第一名，比之前榜单上同业第一名有显著性能提升，部分数据集上的性能提升甚至超过 2 倍以上。

零一万物表示，笛卡尔向量数据库将用在近期即将正式亮相的 AI 产品中，未来也将结合工具提供给开发者。

解决大模型四大缺陷，向量数据库成 AI 2.0 基础设施

向量数据库，又被称为 AI 时代的信息检索技术，是检索增强生成（Retrieval-Augmented Generation，RAG）内核技术之一。随着大模型为代表的 AI 2.0 时代到来，图片、视频、自然语言等多模态的非结构化数据量陡增，区别于用来处理结构化数据的传统数据库。向量数据库专门用来存储、管理、查询和检索向量化的非结构化数据。它就像一块外接的记忆盘，可供大模型随时调用，以形成“长期记忆”，也被昵称为大模型记忆的“海马体”。对大模型应用开发者来说，向量数据库是非常重要的基础设施，在一定程度上影响着大模型的性能表现。

图源：DALL·E 生成

大模型天然有 4 个缺陷，向量数据库仿佛量身定制的“特效药”，能精准解决每个痛点。

实时信息：大模型训练时间长、更新慢，无法反应最新的信息，其知识存在“截止期”的挑战。向量数据库采用轻量化更新机制，可以快速补充最新信息。
隐私保护：用户的安全隐私数据不宜直接提供给大模型训练，否则会有泄密风险，向量数据通过在推理阶段扮演信息传递的中间载体，破解了隐私保护的难关。
幻觉矫正：大模型常表现出的推理失真或产生幻觉的现象，可以通过向量数据库提供的丰富知识参照，有效矫正和减轻此类问题。
推理效率：大模型推理成本高，向量数据库能够作为一种缓存机制，避免每一次查询请求都需要重新执行复杂的推理计算，极大地节省了计算资源。

AI 2.0 掀起的科技变革和平台变革，进一步强化了向量数据库的作用。Google、微软、Meta 等大厂的相关产品先后问世，Zilliz、Pinecone、Weaviate、Qdrant 等创业公司也异军突起。2023 年，OpenAI 的向量数据库合作方 Pinecone 完成了 B 轮 1.38 亿美元融资，国内初创企业 Fabarta ArcNeural 也完成了上亿元 Pre-A 轮融资。

挑战权威向量数据库性能评测，笛卡尔包揽 6 项第一

ANN-Benchmarks 是当下业界最权威的向量数据库性能测试工具，它可以展示不同算法在不同真实数据集下的表现。

下面 6 份评测数据集涵盖 glove-25-angular、glove-100-angular、sift-128-euclidean、nytimes-256-angular、fashion-mnist-784-euclidean、gist-960-euclidean，横坐标代表召回、纵坐标代表 QPS（每秒内处理的请求数），曲线位置越偏右上角意味着算法性能越好，零一万物笛卡尔向量数据库在 6 项数据集评测中都处于最高位。

图注：截至 3 月 10 日，ANN-Benchmarks 6 项评测中，笛卡尔（Descartes）向量数据库位居 TOP1

众所周知，“吞吐量 QPS” 是衡量信息检索系统（例如搜索引擎或数据库）查询处理能力的重要指标。在原榜单 TOP1 基础上，零一万物笛卡尔向量数据库实现了显著性能提升，部分数据集上的性能提升超过 2 倍以上，在 gist-960-euclidean 数据集维度更大幅领先榜单原 TOP1 286%。

图注：零一万物笛卡尔向量数据库与原榜单 TOP1 QPS 性能对比

笛卡尔向量数据库背后的技术揭秘

RAG 是一种结合了检索和生成的技术，它通过从海量数据中检索查询到的信息，来增强语言模型的生成能力。和传统检索方法类似，从本质上讲，RAG 向量检索主要解决两大问题，分别是通过建立某种索引结构，减少检索考察的候选集；以及降低单个向量计算的复杂度。

针对针对第一个问题，零一万物团队采用两大策略予以解决：

全导航图技术。目前业内现状主要通过哈希、KD-Tree、VP-Tree 等方式，导航效果不够精确，裁剪力度不够，零一万物研发的全局多层缩略图导航技术，图上坐标系导航，既能保证精度，又能裁剪大量无关向量。
自适应邻居选择策略，填补业界空白。零一万物自研的自适应邻居选择策略，突破了以往仅依赖真实 topk 或固定边选择策略的局限，新策略使每个节点可以根据自身及邻居的分布特征动态地选取最佳邻居边，更快收敛接近目标向量，从而让 RAG 向量检索性能提高 15%-30%。

针对第二个问题，零一万物采用了两级量化方案增强 RAG。通过用两级量化降低计算复杂度，同时列式存储充分利用 SIMD 的并发能力，进一步发挥硬件能力，相比传统 PQ 查表，性能得到大幅提升到 2-3 倍。

除此之外，还有索引结构优化、连通性保障等全栈向量技术方案提高笛卡尔向量数据库的性能。

向量数据库将成为决定大模型天花板的关键要素

零一万物笛卡尔向量数据库目前聚焦于高性能向量数据库，在实际应用场景中具备精度更高、性能更强等核心优势。高性能向量数据库通常是指向量数据集规模在千万级及以下（如 2000 万 128 维浮点型向量），通常而言，高性能向量数据库可以轻松应对百分之八九十的日常场景，比如帮助企业客户构建私域知识库、智能客服系统；在自动驾驶领域，使用高性能向量数据库可来加速自动驾驶模型训练等。

以电商推荐场景为例，上架商品数量可能千万级，每个商品可以由一个向量表达。即使库中向量数不算很大，如果电商用户基数非常庞大，高峰时每秒用户请求数非常大，可能达到几十万甚至上百万的 QPS。使用高性能向量数据库可以有效提升电商场景里面搜索、广告业务的推荐效果，让大家忍不住一直买买买。

零一万物表示，笛卡尔向量数据库是团队基于 RAG 的初步尝试，将在近期发布的 AI 生产力产品中得到有效应用。未来各家大模型优化到一定程度后，向量数据库的能力可能决定各家大模型的天花板。