最近在试着用LoRA微调Llama3-8B做中文医疗问答,数据集是自己整理的8000条QA对,清洗过,utf-8编码。训练时loss从1.8降到0.9,看起来挺正常,但推理时经常输出重复的“嗯嗯嗯”或者夹杂英文和乱码,偶尔能出几句通顺的中文但答非所问。学习率用的2e-4,rank=8,alpha=16,max_length=1024,跑了3个epoch。想请教一下这种情况一般是数据量不够、格式问题(比如没加合适的system prompt),还是LoRA超参数设置不合理?另外看有人说要冻结embedding层,这个影响大吗?有点迷茫,希望有经验的朋友指点一下方向,谢谢。