最近在做一个内部知识库问答,用的chunking+faiss+Qwen2.5-7B,embedding是本地跑的bge-small-zh。结果发现检索出来的top5经常文不对题,比如用户问“离职流程”,召回的全是“入职培训”相关段落。我怀疑是embedding模型太小,语义区分度不够。