最近在做本地知识库问答,用的bge-m3做embedding,检索top20之后接了个rerank环节,试了bge-reranker-base和cohere的api,但发现开源那个效果明显拉胯,有些相关文档直接被排到后面去了,反而把不相关的顶上来。用的chunk大概300字,重叠50,Faiss检索。想问问大家,开源rerank模型是不是普遍不如闭源?还是说需要微调?另外有没有必要上cross-encoder,还是说直接用LLM自己重排就行?有点迷茫,求指点。