最近在做知识库问答,用的RAG架构。我发现一个问题:如果Prompt只写“根据上下文回答”,检索回来的内容经常答非所问,尤其是多文档融合的时候。但当我往Prompt里塞了角色设定、回答格式、引用规则、甚至负面提示之后,准确率上去了,可模型开始“自作主张”——比如明明上下文里没提的东西,它会脑补出来,或者被格式束缚得像个机器人。我试过调temperature和top_p,感觉治标不治本。所以想问问有经验的前辈,RAG的Prompt设计有没有一个比较系统的思路?比如哪些指令该放System,哪些该放User,或者怎么做消融测试来找到那个“甜点”?先谢过大家了。