最近在搞一个多Agent任务分配的项目,用LangGraph搭了三个子Agent(检索、总结、验证),在OpenAI接口上调通了,效果还行。但问题来了:生产环境要上私有化部署,得把推理换成本地模型。我现在用PyTorch写了个简单的transformers推理脚本,但发现跟LangGraph的状态机衔接很别扭——每次Agent间传消息都得手动序列化成JSON,还要自己管理对话历史和工具调用的上下文窗口,感觉比直接用LangChain的LangServe还要折腾。有没有类似经历的朋友?是继续在LangGraph里硬接自定义PyTorch模型,还是干脆把整个流程用PyTorch重写一遍(哪怕放弃图编排)?主要纠结重写后多Agent的容错和重试逻辑成本太高。求过来人指点。