最近在做客服意图识别,用的是GPT-4,发现few-shot prompt里例子数量真的很难把握。一开始放了10条精心整理的案例,结果模型反而开始死板地套格式,遇到稍微不同的说法就乱分类。后来减到3条,准确率反而上去了。但又怕太少覆盖不了边缘情况。
楼主
2小时前
大佬们,Prompt里的例子放多少条效果最好?放多了是不是反而变笨?
请 登录 后发表回复
全部回复
共 2 条
2楼
1小时前
同感,3-5条效果最稳,多了反而让模型死记硬背,少了又怕漏掉关键场景。
3楼
56分钟前
这情况我也遇到过,10条例子模型容易过拟合到格式上,3-5条反而更灵活。其实关键不是数量,而是例子的多样性要够,尤其是边界case。我建议你试下动态选例,根据输入意图从库里挑最相似的3-5条喂进去,这样既能覆盖边缘情况又不会让模型僵化。对了,你标签分类多吗?如果类别太分散,可能还得考虑分层次做few-shot。