最近在做RAG项目,用的开源模型做embedding,存到向量里。现在纠结存储方案,看很多帖子说专门的向量数据库(比如Milvus、Qdrant)性能吊打ES,但公司现有技术栈是ES,不想再引一套新的。我测试了一下ES的KNN检索,小规模数据(几万条)感觉还行,但不知道数据量到百万级或者并发上来之后会不会崩。有没有实际踩过坑的朋友说说?另外,如果只用ES的话,分片、内存这些参数要怎么调才能扛住?还是说干脆狠心用个专门的向量库更省心?求真实经验,别光说理论。