最近在折腾 MCP 的模型微调,用的是 LLaMA-Factory 那套流程。数据是自己整理的对话格式,大概 3k 条,按照 alpaca 的模板转的。跑起来 loss 从 2.3 开始,到 1.8 就卡住不动了,eval loss 还轻微反弹。试过调低学习率到 1e-5,加了 warmup,效果不明显。看有人说 MCP 对数据格式比较敏感,是不是我 template 没对齐?还是说 3k 数据量本身就不太够?有没有踩过类似坑的朋友,求指点一下方向。