最近在做一个内部知识库的RAG项目,基于开源的embedding模型+FAISS,用LangChain搭的pipeline。本地测试时top5召回看着还行,但一上线生产环境,用户反馈时好时坏——尤其是一些长文档拆分后,明明内容相关,检索出来的片段却老是漏关键细节。我试过调chunk_size(从200调到800)和overlap,也换过bge和m3e,但问题依旧。想请教大家:这种“效果不稳定”的情况,更可能是chunk切分策略没适配文档结构,还是说该考虑换更强的retriever(比如混合检索或rerank)?有没有什么排查路径可以分享?先谢过各位大佬了。