最近在做一个内部知识库的Agent,用Qwen2.5-7B接了公司的API工具。Base模型直接few-shot效果还行,但一遇到多轮对话里的工具参数提取就崩,比如用户说“帮我查下张三上个月的报销单”,模型总把“张三”和“上个月”对应错字段。我拿了几百条历史工单做了LoRA微调(r=8,alpha=16),训完单轮指令准了,但塞进Agent流程里,工具调用还是经常漏参数或者格式错。已经调过温度、加了system提示,甚至试过把工具描述改得更详细,都没啥大改善。有点怀疑是不是微调数据里工具调用的样本太少了(大概只有80条左右),还是说7B模型做这种结构化输出本身就吃力?想请教下各位,你们微调Agent模型时,工具调用的数据一般要多少条才够?或者有没有什么数据构造上的技巧?