做了一阵子RAG,用的Chroma + 开源embedding模型,文档切块也试了512和256,top-k调到5了,但检索出来的片段经常和问题语义对不上,比如问“续费流程”它给我返回“退款政策”…… 我怀疑是不是向量数据库本身检索能力不行?看很多吹Milvus、Weaviate的,说性能好但好像都是工程上的优势,语义召回这块算法不都差不多吗?还是说需要配重排序或者做query改写?求过来人指点下,现在卡这儿很迷茫。