最近在做一个文档问答的RAG项目,用的LangChain+OpenAI。检索出来的chunk明明看着相关,但LLM生成答案总是“差一口气”,感觉是把无用信息也揉进去了。我试过在Prompt里强调“只根据给定内容回答”,也加了让模型“不知道就直说”的约束,效果还是不稳定。想问下大家,RAG场景下的Prompt模板一般怎么设计?要不要把原始query和检索到的chunk做重写或压缩再喂给模型?还是说需要在召回阶段就做rerank?感觉自己卡在这块了,求指点。