最近在调一个基于本地知识库的RAG问答,用的OpenAI接口加向量检索。我为了让模型更“懂”文档,在Prompt里把检索到的top5 chunk全塞进去了,还加了各种角色设定和“请严格基于以下内容回答”的强调。结果发现,只要上下文超过2000字,回答就开始胡言乱语,甚至编造文档里没有的信息。把chunk数降到3个、Prompt精简后反而靠谱多了。