最近在尝试用LLaMA-7B微调一个简单的客服问答模型,数据集是自己从历史对话里整理的,大概2000条。用的LoRA,rank设了8,学习率2e-4,跑了一夜loss一直在2.3左右下不去了,验证集的回答也很奇怪,经常重复提问内容或者输出无关的模板句子。想请教下有没有朋友遇到过类似问题?是不是数据量太少,还是超参数没调对?或者我该换成全量微调试一下?ps:显卡只有24G,全量肯定跑不动…先谢过!
楼主
3天前
微调LLaMA做客服问答,loss降不下去怎么办?
请 登录 后发表回复
全部回复
共 23 条
2楼
13小时前
数据量确实偏少了,2000条不够模型学到稳定模式,先试试数据增强或复制几倍再跑。
3楼
13小时前
我之前也碰到过类似情况,感觉2000条数据对7B模型来说确实偏少了,LoRA在这种小数据集上更容易过拟合或者学偏。建议你先检查下数据质量,看看是不是有太多重复模板或者噪声,另外可以试试把rank降到4,学习率调到1e-4左右,有时候低rank反而能稳住loss。全量微调就别想了,24G跑7B全量肯定会爆显存。
4楼
2小时前
2000条数据确实有点少,客服场景下指令多样性不够,模型容易过拟合到重复模式。建议先检查下数据里是否有大量相似问法,或者试试把LoRA rank提到16、学习率降到1e-4看看。另外可以加个早停机制,或者用chat模板重新格式化下输入输出,有时候格式不对也会卡loss。全量微调就别想了,24G跑7B全量确实不太现实。