最近在做RAG项目,数据量大概几百万条,维度768。一开始用的pgvector,感觉效果还行,但看技术文章都在推专门的向量数据库(Milvus、Pinecone之类的)。我有点纠结:现在pgvector能跑,但查出来结果有时候不太准,不知道是不是因为没调好索引参数?换专门的向量数据库,学习成本和运维成本又高。想问下大家实际项目中,数据量到什么级别或者什么场景下,才值得从pgvector迁移到专用向量数据库?或者是我姿势不对,pgvector还能再优化?求指点。
最近在做RAG项目,数据量大概几百万条,维度768。一开始用的pgvector,感觉效果还行,但看技术文章都在推专门的向量数据库(Milvus、Pinecone之类的)。我有点纠结:现在pgvector能跑,但查出来结果有时候不太准,不知道是不是因为没调好索引参数?换专门的向量数据库,学习成本和运维成本又高。想问下大家实际项目中,数据量到什么级别或者什么场景下,才值得从pgvector迁移到专用向量数据库?或者是我姿势不对,pgvector还能再优化?求指点。
暂无回复,快来抢沙发吧