最近在做RAG项目,数据量大概几百万条文本embedding,之前图省事直接用pandas+faiss硬搞,现在查出来太慢了。看了一圈向量数据库,Milvus和Qdrant都试了,但感觉越用越懵。Milvus部署起来好重,还要搞etcd那些,但社区说性能好;Qdrant轻量很多,Python直接pip就能跑,但不知道能不能扛住生产环境。有没有实际跑过类似规模的老哥,说说选型时候到底该关注哪些坑?另外,我看很多文章都在吹HNSW,但实际调参的时候,efConstruction和M到底怎么配才合理?现在最烦的是,项目急着上线,没时间把每个库都深度吃透,求一条明路。