最近在做一个内部知识库问答的Agent,用的LangChain+GPT-4o-mini。任务其实很简单:根据用户问题检索相关文档,然后总结回答。但实际跑起来发现,有时候用户问“报销流程是什么”,它能答得挺好;换个问法比如“发票怎么贴”,它就直接说“没有找到相关信息”,但其实库里有这个文档。我试过调top_k、换embedding模型,也加了prompt模板强调“先检索再判断”,但效果不稳定。看网上不少人说LangChain太抽象,隐藏了很多细节,不如直接调OpenAI API自己写流程。现在有点迷茫,是继续调参优化,还是干脆用原生API重写一个可控的流程?有没有过来人给点经验?