最近在搞一个内部知识库的MCP服务器,想用微调让模型更懂我们公司的工具参数。我用的Llama-3-8B,LoRA秩设了32,alpha设64,训练了3个epoch,loss看着挺正常(1.2左右)。但一接到真实MCP请求,比如让它调“创建工单”这个工具,模型要么把参数名改成幻觉字段,要么直接报JSON解析错误,甚至有一次把工具名都改了。