最近在做多轮对话的Agent,把系统提示词拆成角色+任务+限制的模板,还加了一堆few-shot示例。结果单轮测试没问题,一旦多轮上下文变长,模型就开始答非所问,甚至忽略我后输入的明确指令。对比之前纯手写的自然段落,反而没那么严重。是不是模板结构太“工整”导致注意力被分散?或者few-shot和真实场景的分布差距太大?有类似踩坑的朋友吗?你们是怎么平衡结构化提示和灵活性的?