最近在做RAG项目,想把公司一堆PDF文档做成知识库,方便员工查资料。看教程说LangChain生态大、文档全,但LlamaIndex好像专为RAG设计,索引功能更强。我试了LangChain的Chroma+OpenAI,结果检索回来的片段经常不相关,调chunk size和overlap也没搞明白。LlamaIndex的文档树结构又有点复杂,不知道是不是我数据预处理太糙了。另外,有没有必要上向量数据库?还是用FAISS本地就够了?求过来人指点,最好能说说坑在哪,我快被这些框架选择整emo了。