RAG向量数据库选型关键指标

article
2026年7月21日阅读约 1 分钟69 字

更新于 2026年7月21日

RAG向量数据库选型关键指标

RAG 系统中评估性能、索引类型与集成度的关键维度

原题:在构建基于大模型的检索增强系统时,如何评估和选择合适的向量数据库?请从性能、可扩展性、支持的索引类型、查询延迟、与现有技术栈的集成等方面进行详细说明。

评估与监控 · 京东真题

回答与解析

选型核心维度

  1. 性能与索引类型
  • HNSW:图索引,召回率高、查询快(1-10ms),但内存占用大,适合百万-千万级稠密向量

  • IVF+PQ:倒排+乘积量化,内存省、支持十亿级,查询稍慢(10-50ms),适合大规模稀疏访问

  • DiskANN:内存+SSD混合,平衡成本与性能,十亿级首选

  1. 可扩展性
  • 水平扩展能力:是否支持分片(sharding)和动态扩缩容

  • 写入吞吐:批量导入速度、实时更新延迟(部分库写放大严重)

  1. 延迟与成本权衡
场景 推荐方案
在线QPS>1万、延迟10亿) 自研或Elasticsearch 8.x的dense_vector
  1. 技术栈集成
  • 优先选有成熟Python/Go SDK、支持LangChain/LlamaIndex的

  • 云原生:是否支持K8s operator、Serverless计费模式

京东场景建议

电商搜索对延迟极敏感,推荐Milvus/Zilliz或阿里自研Proxima:

  • 商品向量千万级,用HNSW保证关键一句:多模态场景下,向量数据库是否支持多向量字段和跨模态检索

面试官还可能这样问

  1. 问法 1 · 场景切入假设我们做一个电商搜索系统,每天千万商品向量要实时检索,用户点一下就要结果。你选向量数据库会重点看哪些指标?比如性能、延迟、扩展性这些,怎么权衡?
  2. 问法 2 · 层层追问你觉得向量数据库选型主要看什么?……如果查询量很大,比如每秒上万次,延迟必须5ms以内,你优先考虑什么?……那数据量上亿了,内存放不下,怎么平衡成本和速度?
  3. 问法 3 · 直球架构你负责给一个RAG系统选向量数据库,要求支持十亿级向量、查询延迟<10ms、能水平扩展。请从索引类型、性能、可扩展性、技术栈集成这几个维度,说说你的选型思路和理由。