最近在做一个基于企业知识库的RAG问答,检索部分用的bge-m3,召回top5文档,然后拼进一个Prompt模板里让qwen-plus生成回答。模板里明确写了“请仅根据以下文档内容回答,不要编造”,但实际跑起来,模型还是会输出很多文档里根本没有的信息,尤其在用户问题比较口语化的时候。我试过调整温度、换过不同的模板措辞,比如“如果文档中没有答案,请直接说不知道”,但效果还是不稳定。想请教下大家,这种情况下是不是跟检索质量也有关系?还是说Prompt里对“文档边界”的约束写法有问题,或者需要把检索内容做额外处理(比如分段落标注)再喂进去?希望有经验的朋友指点下排查思路。