最近在做一个中文客服问答项目,基于Llama3.1-8B做LoRA微调。数据集是自己整理的2000条客服对话,清洗过,格式也按官方模板对齐了。训练时loss降到0.8左右就不再下降了,跑完3个epoch后测试。