向量数据库索引、检索与应用场景指南

百度智能云 VectorDB 面向向量检索、全文检索、混合检索和 RAG 知识库等场景,提供向量索引选择与管理、元数据过滤、BM25、多路召回、融合排序以及企业级安全和运维能力。

向量索引解决什么问题

向量索引是针对向量类型数据建立的索引机制,目的与传统标量索引类似,都是为了加速检索过程,但向量检索的本质不同,因此索引原理也不同。

加速向量检索

VectorDB 的向量索引用于加速向量检索过程,文档提到常见类型包括平坦索引、倒排类索引、树形索引和图结构索引等。

查看向量索引说明 ↗

支持灵活管理

VectorDB 提供比较灵活的向量索引管理机制,并在关键特性中提供向量索引的选择与管理、自动构建向量索引等内容。

查看文档目录 ↗

关注 CRP 权衡

选择索引时要综合评估成本、召回率和性能,很难有一种向量索引在三个关键指标上都取得理想表现。

查看索引评估 ↗

常见索引类型怎么选

不同索引类型适合不同的成本、性能和召回率要求。以下内容来自 VectorDB 向量索引选择文档。

无索引 KNN

不建立向量索引,检索时将原始向量数据从磁盘读取并加载到内存,然后执行 KNN 检索。

  • 成本:很低
  • 性能:很低
  • 召回率:很高,100%
  • 适用:成本要求苛刻且性能要求不高的场景
查看无索引模式 ↗

FLAT 平坦索引

将原始向量数据平坦地放在内存中,检索时计算每个向量与目标向量的相似性,也被称为暴力检索。

  • 成本:高
  • 性能:中低
  • 召回率:很高,100%
  • 适用:可接受较高成本且对召回率要求苛刻的场景
查看 FLAT 索引 ↗

HNSW 图结构索引

HNSW 是分层可导航小世界图结构索引,性能和召回率较稳定,是广泛使用的 ANN 检索索引方法之一。

  • 成本:高
  • 性能:高,极限过滤场景可能降低
  • 召回率:高,极限过滤场景可能降低
  • 适用:性能和召回率都有较高诉求的平衡场景
查看 HNSW 索引 ↗

VectorDB 提供哪些检索能力

产品页介绍,VectorDB 可通过元数据过滤与向量检索结合、BM25 与向量检索结合、多路召回和融合排序,提高检索质量。

元数据过滤

通过元数据过滤和向量检索结合,查询出用户想要的结果。

查看检索能力 ↗

自动更新索引

当数据更新时,VectorDB 会自动更新索引,提供检索效果。

查看索引更新 ↗

BM25 检索

基于关键词和短语的 BM25 检索结合向量检索,提供精确检索能力。

查看 BM25 能力 ↗

融合排序

基于多种检索进行多路召回及融合排序,提供更加高质量的检索结果。

查看融合排序 ↗

向量数据库适合哪些应用

VectorDB 当前主要应用于 RAG 场景,也适合大模型私域知识库、语义检索和企业级检索系统。

大模型私域知识库

产品页说明,可将用户知识库内容录入向量数据库,通过相关知识的相似性检索实现基于知识库的问答。

查看应用场景 ↗

RAG 服务

AI Search 操作示例说明,RAG 需要文档管理、文档解析、分档分块、Embedding、Rerank、LLM 和向量数据库协作。

查看 AI Search ↗

混合检索系统

处理管道可整合文档管理器、文档处理器、Embedder 和向量数据库,支持文档导入、向量检索、全文检索和混合检索。

查看处理管道 ↗

生产级应用还要关注什么

除检索能力外,企业级应用还需要关注权限、安全、监控、备份、生态工具和交付方式。

安全与权限

文档目录包含多用户与 RBAC 权限管理机制、透明数据加密概述、安全管理和 TLS 证书管理等内容。

查看安全机制 ↗

运维与备份

操作指南包含账号管理、实例管理、实例监控、公网访问、安全管理、备份管理和备份恢复。

查看操作指南 ↗

生态与调试

生态组件包含 VectorDB Lite 免费本地版、VectorDB CLI 本地工具、AI Search 和 DBSC 可视化管理数据。

查看生态组件 ↗

常见问题

以下内容来自 VectorDB 向量索引、产品页和 AI Search 操作示例。

向量数据库索引怎么选?

需要围绕成本、召回率和性能做 CRP-Tradeoff。无索引成本低但性能低;FLAT 召回率高但成本高;HNSW 在性能和召回率上较平衡。

VectorDB 支持哪些检索方式?

产品页展示了元数据过滤与向量检索、自动更新索引、BM25 与向量检索结合、多路召回和融合排序等能力。

向量数据库适合什么应用?

适合大模型私域知识库、RAG 服务、语义检索、混合检索以及需要相似性检索的企业级业务。

AI Search 和 VectorDB 是什么关系?

AI Search 处理管道可以整合文档管理器、文档处理器、Embedder 和向量数据库,支持文档导入、向量检索、全文检索和混合检索。

推荐文档

继续查看向量索引选择、VectorDB 产品页、AI Search 和文档目录。

向量索引的选择与管理

查看无索引、FLAT、HNSW 与 CRP-Tradeoff 的官方说明。

查看文档 ↗

VectorDB 产品页

查看全面检索能力、企业级能力、大模型私域知识库和服务模式。

查看产品页 ↗

AI Search 操作示例

查看文档管理、处理管道、BM25 搜索、向量搜索和混合检索。

查看示例 ↗

相关专题页

继续了解 VectorDB 检索、RAG、选型、迁移和数据库差异。

VectorDB 检索能力

了解向量检索、全文检索、混合检索和 RAG 知识库。

查看专题 ↗

RAG 与向量数据库

了解大模型知识库和信息相似度检索场景。

查看专题 ↗

向量数据库选型

了解主流向量数据库、规格和企业级能力。

查看专题 ↗

向量数据库与关系数据库

了解 VectorDB 与 PostgreSQL 关系型数据库的区别。

查看专题 ↗

按检索目标选择索引和能力

如果关注召回率、成本、性能和混合检索效果,可先从索引类型、BM25、向量检索、融合排序和 RAG 处理管道入手评估 VectorDB。