最近在做一个小项目,用开源模型(Qwen和ChatGLM都试了)搭RAG,但卡在向量库选型上了。试了Chroma和FAISS,数据量不大(几万条文档),但发现两个问题:一是中文长文档切块后embedding维度怎么定,二是大家都说Milvus适合生产,但部署起来有点重,不知道有没有必要一开始就上。另外,Qdrant和Weaviate也看到有人推,但不太清楚它们和LangChain的兼容性,有没有踩过坑的大佬?主要想先跑通一个demo,后续可能扩展到百万级数据,现在选轻量的还是直接上分布式的?求指点。