最近在做一个内部用的Agent,需要让模型根据用户指令调用几个内部API。我基于Qwen2.5-7B做了LoRA微调,训练数据就是“指令-工具调用序列”的格式,大概攒了5000条,验证集loss看着也降下去了。但一放到真实的Agent流程里,模型经常在输出工具参数时多出几个换行或者空格,或者偶尔把工具名写错一个字母,导致解析直接失败。我试过把温度调低、加few-shot示例,但效果不稳定。想问问大家,这种“能理解意图但格式不听话”的问题,一般是数据构造的问题,还是微调本身的局限性?有没有什么工程上的trick能兜底?