最近在做一个知识库问答的落地项目,底层用的是GPT-4o,我自己写了一套系统提示词,把角色、任务、输出格式都规定了,还给了两个few-shot例子。但测试下来发现,同一个问题多问几次,偶尔会漏掉关键字段,或者回答语气跑偏。