最近在做一个垂直领域的知识库问答,用的RAG架构。数据是PDF切块后embedding到向量库,top-k从5调到了15,召回率(hit rate)确实涨了不少,但生成答案却开始出现幻觉,甚至把不同文档里的信息拼错了。我怀疑是chunk粒度或者rerank的问题,也试过调prompt限制只基于上下文,但效果不稳定。有没有大佬遇到过类似情况?是应该降top-k还是换更精细的混合检索?或者干脆对chunk做摘要再入库?求个思路,实在有点摸不着头脑。