最近在做个人知识库的RAG,用的Qwen2.5-7B加本地Embedding(bge-m3)。文档主要是PDF论文和技术博客,我按固定512字符切分,overlap设了64。现在问题是很多问题检索到的片段完全不相关,甚至答非所问。我试着调了top_k从3到10,效果还是不稳定。想问下各位,这种情况一般是切分策略的问题还是Embedding模型不够强?有没有必要换bge-large或试下混布?另外,像这种长文档有没有推荐的切分思路,比如按段落还是按语义边界?我有点迷茫,感觉每一步都试了但就是卷不动效果。求指点一个排查方向。