最近在做一个基于Qwen2.5-7B的Agent项目,工具调用用的是ReAct格式。跟着教程用LLaMA-Factory做了LoRA微调,训练时loss降得挺漂亮,但一接到真实的Agent框架(用的LangGraph)里就崩:模型经常不输出Action:字段,或者直接幻觉出根本不存在的工具名。
我确认过微调数据里是带了工具描述的,模板也是按官方文档写的。想问问有经验的朋友,这种微调后的模型接入Agent时,是不是还要专门做对齐(比如system prompt、工具定义格式)?还是说我的训练数据本身就有问题?有没有排查的思路?感谢!