最近在做RAG项目,把文档切块后用embedding模型转成向量存起来,然后在检索阶段用相似度搜索找相关片段。但选向量数据库这块把我整懵了。试了Milvus,部署起来配置挺多,但感觉社区活跃、功能全;Pinecone看着简单,但毕竟是云服务,怕后面费用高。主要困惑是:对于中小规模(几十万条向量)的问答场景,到底有必要上Milvus吗?还是直接本地用FAISS凑合?另外,Pinecone的免费额度够不够做原型验证?希望有实战经验的朋友给点建议,别让我在选型上浪费太多时间。