最近在用LangGraph搭一个客服Agent,知识库走的是RAG。遇到个头疼的问题:用户问一个稍微绕一点的问题(比如“上次那个订单为什么没发货,后来怎么处理的”),Agent在工具调用时经常检索到不同的片段,导致多轮对话里前后结论对不上。我试过调top_k和阈值,也试过加rerank,但感觉还是治标不治本。而且有时候Agent自己会改主意,明明第一轮已经给出了答案,第二轮又说“需要进一步确认”。想问下大家,这种情况是应该做记忆压缩还是加状态校验?或者有没有什么工程上更稳的方案,比如把检索结果做一次投票或者强制让Agent引用原始片段?真心求教,感觉自己陷在细节里了。