最近在做RAG项目,用的Milvus + OpenAI的text-embedding-ada-002。问题是检索出来的top5片段经常跟问题语义关联不大,尤其是一些需要推理的问题,感觉向量检索就是纯字面匹配。我目前chunk大小设的是500字符,overlap设了50,试过换bge-m3效果也差不多。
暂无回复,快来抢沙发吧
模型使用、微调、部署