最近在做公司内部的RAG知识库,用的LangChain+Chroma。文档主要是产品手册和FAQ,中文为主。现在卡在Embedding选型上:本地用BGE-large-zh吧,跑起来慢,还得自己维护模型服务;直接用OpenAI的text-embedding-ada-002,效果确实好,但数据要传到国外API,合规上过不去。我想问下有没有做过实际对比的朋友,BGE-large和ada在检索准确率上到底差多少?另外像m3e或者text2vec这种轻量模型,在长尾专业术语多的情况下会不会掉点很严重?现在有点纠结是牺牲一点精度保合规,还是咬咬牙搭个GPU服务上大模型。求有经验的大佬指点下选型思路。