最近在做公司内部的文档问答,用的开源RAG方案。检索倒是没问题,top5基本都能命中关键段落,但生成出来的答案总感觉“机械感”很重,有时候甚至把不相关的上下文硬凑进回答里。我试过在system prompt里强调“只基于给定上下文”,也试过给每个chunk加来源标签,但效果不稳定。想请教下各位,RAG场景下Prompt的结构(比如先指令后上下文,还是穿插示例)对最终输出影响大吗?有没有什么调优经验,比如怎么处理多文档信息冲突,或者怎么让模型学会说“信息不足”?