最近在尝试用Llama2-7B做我们电商平台的客服问答,用LoRA微调,rank=8,alpha=16,学习率从2e-4试到5e-5,batch size也调过,但loss一直在0.8-1.2之间上下波动,降不下去。训练集是5000条人工标注的问答对,每条大概100-200个token。看了一下输出,模型经常生成一些“好的,我理解你的问题”这种废话,然后回答也是套话,感觉没真正学到业务知识。我怀疑是不是数据集太少了?还是LoRA参数没设对?用ChatGLM3试过效果也差不多。有没有大佬指点一下这个阶段一般怎么排查?先谢谢了。