最近在搭一个面向企业文档的RAG问答,用的开源模型是Qwen2.5-7B,embedding换了好几个,从bge-large到gte-large,chunk也调了(256/512都试过),但检索回来的片段经常和问题主题没太大关系。比如问“服务器采购流程”,召回的前几段里居然有关于售后维修的。已经试过调top_k和相似度阈值,效果改善有限。想请教下大佬们,这种情况问题一般是出在embedding模型本身,还是说跟chunk切分策略、甚至rerank环节缺失有关系?如果要上rerank,开源方案有哪些值得推荐的呢?先谢谢了。