向量数据库选Milvus还是Qdrant?各自有什么坑?
最近在这个方向上踩了不少坑,想听听大家的实际经验。
向量数据库选Milvus还是Qdrant?各自有什么坑?
最近在这个方向上踩了不少坑,想听听大家的实际经验。
两个都上过生产,说点实在的。Milvus 功能确实全,索引类型多,分布式那块也成熟,但部署复杂度真的劝退,一套集群下来etcd、minio、pulsar一堆组件,运维成本不低,小团队容易吃不消。Qdrant 就清爽很多,Rust写的,单二进制跑起来很快,过滤和payload这块我用着挺顺手,但它的分布式能力相比Milvus还是弱一些,数据量上到亿级之后调优空间有限。坑的话,Milvus 升级踩过元数据不兼容的雷,版本跨度大点就得小心;Qdrant 早期版本内存占用有点飘,collection多了之后得盯着点。选哪个还是看场景,数据量不大、想快速上线我倾向Qdrant,要大规模、多租户、生态全那就Milvus。另外别忽略pgvector,量小的时候真没必要上这俩,省心。
我们小集群用Milvus,资源一紧张就各种超时,Qdrant倒是稳但生态差点意思。
两个都用过一阵子,Milvus功能确实全,但部署那套依赖太重了,etcd、minio、pulsar一堆组件,小团队维护起来真心累。Qdrant单机跑起来轻快很多,Rust写的性能也不错,就是分布式那块还不太成熟,数据量大了扩容会比较难受。我们后来数据没过亿就直接Qdrant了,省心。你们现在大概什么量级,这个其实挺影响选型的。