最近在做一个企业知识库问答,文档主要是PDF和Word,大概几千页吧。用的LangChain + OpenAI的text-embedding-3-small,chunk_size试过500和1000,overlap也调了,但用户问一些跨章节的问题时,召回的内容总是不全,甚至答非所问。我怀疑是不是embedding模型对中文支持不够好,还是说切块策略本身就有问题?另外,看到有人提到用BM25做混合检索,但不确定我这个场景值不值得加。有没有大佬遇到过类似情况,能给个排查思路或者调优方向?先谢过了。