最近在搞一个私有化部署的代码审查助手,基于Qwen2.5-7B接MCP服务。本地工具(比如git diff、静态扫描)调用还行,但一接远程的HTTP API工具(比如Jira、CI状态查询),模型经常生成错误的参数格式,或者干脆不触发工具调用,直接“脑补”答案。我已经用MCP官方的tool-use样例微调过一轮(LoRA,rank=8,3000条数据),loss降到0.8左右,但实测工具调用成功率才60%。想问问大家:这种问题通常是模型本身tool-calling能力不够,还是我的微调数据分布跟真实MCP请求差异太大?有没有人踩过类似的坑,求分享下经验,比如要不要在system prompt里加更严格的JSON schema约束?