最近在搭一个简单的RAG问答系统,用的LangChain+本地向量库。检索出来的文档片段跟用户问题拼在一起喂给大模型,但效果时好时坏。比如我让模型“只基于提供的文档回答”,结果它有时候会忽略文档自己瞎编,有时候又因为文档里信息不全直接说“不知道”。试过在system prompt里强调规则,也试过在user prompt里把检索内容用标签包起来,但总觉得跟模型预训练的知识在打架。有没有大佬分享下,RAG场景下prompt的结构和措辞有什么经验?比如要不要加few-shot示例,或者怎么平衡“忠于检索”和“合理推断”?感谢!