最近在做一个企业内部知识库的RAG项目,用的bge-large-zh和Qwen2.5-7B,部署完测试时发现效果一言难尽。比如问“报销流程中发票粘贴要求”,检索出来的片段总是把“发票”和“粘贴”拆到不同chunk里,最后模型只能瞎编。我已经把chunk_size调小到200,overlap也试了50和100,但还是不行。另外,直接用faiss检索top5,看召回结果感觉相关度排序也怪怪的,有些明显不相关的片段排前面。想请教下各位大佬,这种问题一般是chunk切分策略的锅,还是embedding模型对长尾术语不敏感?或者说是重排(rerank)环节不能省?现在有点怀疑是不是我整个pipeline哪里没接对,希望有经验的朋友指点一下,谢谢!