最近在做RAG相关的项目,数据量不大,大概几十万条文本embedding。本来想直接用pgvector,因为业务数据本来就在PostgreSQL里,感觉能省一套运维。但看了一圈技术社区的帖子,又说专门的向量数据库(比如Milvus、Qdrant)性能强很多,还支持混合检索、标量过滤什么的。我现在两个都试了试,单机小数据量下pgvector响应其实还行,可又担心后面数据涨上去或者并发高了会崩。想问问有实际部署经验的前辈,这种规模下用pgvector真的够用吗?还是说直接在架构上引入独立向量库更稳妥?另外如果是用pgvector的话,索引选IVFFlat还是HNSW?有说法是数据量小用IVFFlat就够,但看官方文档又推荐HNSW,有点不知道信哪个了。