怎么选,而不是选哪个名字

  • Chroma:本地嵌入式,适合单机原型。
  • pgvector:已有 PostgreSQL、要事务和备份同一套。
  • Qdrant:中小规模、运维人少。
  • Milvus:过滤、量化、mmap 把原向量放磁盘,适合量和运维都上去的阶段。

索引常见 HNSW 和 IVF。内存不够先 SQ8,再考虑 mmap。批量写入会触发 Segment 合并、查询抖动:错峰或小批量间隔几秒,不要把全量重建当日常。

和 Embedding 模型分开看

库管的是存和搜;模型管的是向量从哪来。中文优先在自己的业务集上测召回,MTEB 只作参照。数据不能出境就本地部署 BGE / Qwen Embedding。模型选型细节见已发布的 Embedding / Rerank / LLM 一文,本文不再单开一篇「Embedding 数据库选型」。