最近在搞一个RAG小项目,用bge-m3抽了大概80万条文本向量,之前图省事直接怼进了Elasticsearch,结果召回率一塌糊涂,TopK调到50还是经常漏掉语义相近的句子。现在想正经换个专用向量库,纠结Milvus和Qdrant。看文档感觉Milvus功能全但部署重,Qdrant轻量但怕后期数据量涨了扛不住。有没有大佬实际生产用过?主要关心两点:一是过滤+向量混合检索的延迟,二是10亿级数据下的稳定性。另外,有没有必要为了这个专门上K8s?先谢过各位了。