最近在搭一个简单的ReAct Agent,需要频繁调用LLM和工具,后端逻辑不复杂。本来想直接用PyTorch写,但看到很多Agent框架(比如LangChain、AutoGPT)底层都是TensorFlow Serving或者ONNX部署,心里有点没底。