最近在搭一个简单的RAG问答系统,用的OpenAI embeddings + FAISS,检索出来的文档片段相关性看着还行,但最后生成答案总是不满意。
我现在的prompt模板大概是“根据以下上下文回答问题,如果找不到答案就说不知道”,但模型经常把检索到的内容强行扩写成一段看似合理但细节对不上的回答,甚至自己编数据。
试过加“只基于上下文、不要添加额外信息”、也试过让模型先判断相关性再回答,但效果不稳定。
想问问大家在实际项目里,RAG的system prompt一般怎么写?有没有处理“检索内容噪声多”或者“模型过度发挥”的实用技巧?谢谢。