最近在做一个人社领域的知识库问答,用的RAG+LLM。向量检索top5召回,但答案经常把无关的条款也带进来,甚至引用错误。我试过在system prompt里强调“只根据上下文回答”,也试过在user prompt里加“如果信息不足就直说”,但效果不稳定,有时候同一个query跑两次结果都不一样。更头疼的是,用户提问经常是口语化的,比如“我失业了能拿多少钱”,检索出来的文档片段很碎,拼起来逻辑都对不上。有没有人系统梳理过RAG场景下prompt该怎么分层设计?比如sys提示词、检索后重写、答案约束各管哪块?还是说问题根本不在prompt,是chunk切分和重排的锅?求实战经验,别甩论文,谢谢。