最近在调一个给论文做摘要的prompt,发现一个奇怪的现象。我一开始只写了“请提炼核心观点和实验结论”,效果还挺好,简洁准确。后来为了追求更高质量的输出,我参考网上的模板,加了角色设定、输出格式要求、甚至还有几个“反面示例”和思维链提示,洋洋洒洒几百字。结果模型反而开始频繁跑偏,要么回答得特别啰嗦,把示例里的风格也学进去了,要么就抓不住重点,有时候还自己脑补出一些论文里没有的细节。想问问大家,是我堆砌的指令产生了冲突,还是说这个任务本身就不适合太复杂的prompt?有没有什么判断复杂度的原则?现在有点迷茫,感觉还不如我一开始瞎写的那个简单版本好用。