向量数据库是什么

百度向量数据库 VectorDB 是一款纯自研高性能、高性价比、生态丰富且即开即用的向量数据库服务。支持多种索引类型和相似度算法,百亿级向量规模,毫秒级查询延迟。

VectorDB 的核心定位

VectorDB 面向向量检索和相似度查询场景,提供即开即用的向量数据库服务。

高性能和高性价比

文档首页明确介绍 VectorDB 是一款纯自研高性能、高性价比、生态丰富且即开即用的向量数据库服务。

支持多种索引和算法

VectorDB 支持多种索引类型和相似度算法,用于不同向量检索场景下的数据组织和查询。

面向大规模低延迟查询

VectorDB 支持百亿级向量规模,并提供毫秒级查询延迟。

向量检索能做什么

产品页围绕元数据过滤、向量检索、BM25 检索、多路召回和融合排序说明了检索能力。

元数据过滤结合向量检索

通过元数据过滤和向量检索结合,查询出用户想要的结果。

数据更新后自动更新索引

当数据更新的时候,VectorDB 会自动更新索引,提供最快的检索效果。

BM25 与向量检索结合

基于关键词和短语的 BM25 检索结合向量检索,提供精确检索的能力。

多路召回与融合排序

基于多种检索进行多路召回及融合排序,提供更加高质量的检索结果。

企业级能力和集成能力

VectorDB 产品页还强调模型生态、权限隔离、安全访问和大规模伸缩等企业级能力。

上下游生态集成

VectorDB 产品兼容市面上大部分的模型,并且有百度智能云的大模型生态加持,能帮助使用 VectorDB 的企业用户打通全链路。

多租户与安全访问

  • 多租户隔离,确保不同部门、不同业务线、不同业务单元等具有相应权限。
  • 提供安全白名单、TLS 传输加密,企业级客户可以安全地访问数据。

高可用和伸缩能力

  • 提供对关键业务的更高可用性和可靠性的能力,业务可以获得更高的 SLA 保证。
  • 百亿级向量规模,横向和纵向伸缩能力,大型业务能够更简单高效地使用向量检索能力。

典型应用与服务模式

向量数据库常用于大模型私域知识库,也可以按交付需求选择私有化、公有云或软硬一体服务模式。

大模型私域知识库

把用户知识库内容录入到向量数据库,通过相关知识的相似性检索可以实现基于知识库的问答。

私有化和公有云

私有化适合强数据安全与隐私需求的场景;公有云适合快速体验效果、对部署环节要求不高的场景。

软硬一体

软硬一体适合开箱即用且高可用需求的场景,支持软硬一体交付、高可用保证、多算力资源适配和国产化支持。

推荐文档

继续查看 VectorDB 产品介绍、规格、索引选择和 RAG 示例文档。

向量数据库 VectorDB

了解 VectorDB 的产品定义、索引类型、相似度算法、向量规模和查询延迟。

产品规格

查看向量数据库分布式架构、节点类型、节点规格、标准版和免费版实例类型。

向量索引的选择与管理

了解向量索引的作用、成本性能召回率权衡,以及不同索引类型的适用场景。

千帆+Langchain+VectorDB 建立简单的 RAG 示例

参考千帆、LangChain 和 VectorDB 组合建立简单 RAG 示例的流程。

相关专题页

继续了解 VectorDB 选型、RAG 场景和云数据库内容。

向量数据库 VectorDB 是什么,适合哪些检索场景

向量数据库怎么选:VectorDB 检索能力与规格参考

RAG 与向量数据库:VectorDB 的知识库和检索场景

云数据库 RDS for MySQL 是什么,适合哪些业务场景

查看向量数据库 VectorDB 产品介绍

了解检索能力、企业级能力、私域知识库场景和多种服务模式,继续评估向量数据库使用方案。