最近在做一个企业知识库问答,用的开源RAG方案。向量检索Top5召回其实挺准的,但生成环节老是有问题:要么直接大段复制原文,要么把几个文档内容强行缝合,读起来很怪。我试过在Prompt里加“请基于上下文简洁回答”,也试过限制字数,效果都不稳定。感觉问题出在Prompt对“如何组织多文档信息”的约束太弱,模型不知道怎么取舍。想问问大家,RAG场景下的Prompt设计有什么好的实践?比如要不要强制模型先列出证据再回答?或者把检索到的片段按相关性排序后再喂给模型会有帮助吗?求指点。