最近在搭一个针对公司内部文档的RAG问答,用的bge-m3做embedding,向量库用的milvus。文档是各种技术方案和会议纪要,我按固定长度500字切的,重叠50字。现在问题是用户问一个具体问题,比如“某某项目上次评审定了什么结论”,检索出来的top5里经常只有1条是相关的,其他全是碰巧含有相同关键词但内容无关的片段。我用的是余弦相似度,也试过调低score阈值,但要么召回太少,要么噪声更多。想问问大家,这种混合类型的文档是不是不应该用固定窗口切?还是说需要在召回后加一层重排?有没有比较成熟的实践思路?谢谢。