最近在用LangChain+Chroma搭一个内部知识库的RAG问答,主要是一些技术文档和产品手册。我试了256、512、1024三种chunk_size,但效果都不太稳定。比如查“数据库连接超时处理”,有时候能召回精准的段落,有时候却给了一堆无关内容,感觉和embedding模型也有关系?目前用的是bge-small-zh-v1.5。另外,重叠(overlap)设多少合适?我设了20%,但感觉有的片段被重复切得太碎了。有没有前辈分享下实战中的调参经验?或者有没有更好的向量库推荐?先谢过!
最近在用LangChain+Chroma搭一个内部知识库的RAG问答,主要是一些技术文档和产品手册。我试了256、512、1024三种chunk_size,但效果都不太稳定。比如查“数据库连接超时处理”,有时候能召回精准的段落,有时候却给了一堆无关内容,感觉和embedding模型也有关系?目前用的是bge-small-zh-v1.5。另外,重叠(overlap)设多少合适?我设了20%,但感觉有的片段被重复切得太碎了。有没有前辈分享下实战中的调参经验?或者有没有更好的向量库推荐?先谢过!
暂无回复,快来抢沙发吧