最近在做一个人事制度问答的RAG项目,用的LangChain + 阿里的qwen-plus。检索回来的chunk质量还行,但生成效果时好时坏。我参照网上教程写了个prompt模板,大概就是“你是人事助手,请根据以下文档内容回答,如果文档没有相关信息,就直说不知道”。但发现有些问题比如“年假和调休能一起用吗”,模型还是会自由发挥,把文档里没提的细节脑补出来。我试着把模板改得更严格,加了很多“禁止猜测”“只允许引用原文”之类的词,结果又导致很多能答的问题它也开始拒答。想问问有经验的朋友,这种RAG场景下的system prompt到底应该怎么设计?是应该把重点放在约束模型行为上,还是放在引导它如何利用检索到的片段上?有没有什么具体的措辞技巧,能让模型既不过度发挥,又不至于过度保守?最好能分享下你们实际跑通的模板长什么样,先谢过了。