最近在试LangChain搭Agent做文档问答,用的是ReAct框架+GPT-4。功能简单:用户问一个复杂问题,Agent需要先检索相关信息,再推理,最后给出答案。但跑了几次,发现Agent经常在“选择工具”这一步死循环,比如明明检索到了相关段落,它不去分析,反而重复调用检索工具。更迷惑的是,有时候它还会自己编一个不存在的工具名,然后报错退出。我试过调高temperature、改prompt模板,甚至加了个“如果重复超过3次就强行输出”的逻辑,效果都不稳定。想问问各位踩过这个坑的,有没有更系统的调优思路?或者有没有推荐的中间状态监控方法,能直观看到它每一步在想啥?