最近在尝试用LangChain写一个简单的AI Agent,目的是让大模型能调用几个自定义工具(比如查天气、算算术)。结果跑起来经常翻车——有时候模型死活不调用工具,直接自己瞎编答案;有时候调用了但传的参数格式不对(比如把数字传成字符串)。我看了官方文档,也试了调temperature和top_p,但还是不稳定。是不是Prompt里对工具的说明写错了?还是说现在的开源模型(比如Qwen2.5-7B)在工具调用上本身就弱?有没有靠谱的调试思路?求大佬们指条路,卡好几天了。