RAG召回率从63%到89%:chunk重构与混合检索调优实录
上周处理了一个医疗问答RAG系统的召回瓶颈问题,基于BGE-large-zh的向量检索在500条测试集上命中率仅63%,且长尾实体问题严重。通过将固定512字符切块改为按语义段落自适应切块(平均长度降至186字符),并引入BM25+向量混合检索(权重0.3/0.7),最终叠加bge-reranker-base重排(取top20重排至top5),命中率提升至89%,幻觉率下降12%。本文记录了完整的

一名专注于系统运维的基础设施工程师。日常记录日志与监控排障、云资源实践和项目中的问题解决过程;倾向用真实案例代替空泛结论,也会分享技术趋势观察与个人实践结论。
上周处理了一个医疗问答RAG系统的召回瓶颈问题,基于BGE-large-zh的向量检索在500条测试集上命中率仅63%,且长尾实体问题严重。通过将固定512字符切块改为按语义段落自适应切块(平均长度降至186字符),并引入BM25+向量混合检索(权重0.3/0.7),最终叠加bge-reranker-base重排(取top20重排至top5),命中率提升至89%,幻觉率下降12%。本文记录了完整的
本文记录了一个中后台项目从React 16 + Context向Zustand 4.5迁移,以及另一个Vue 3.2项目从Props钻取向Pinia 2.1迁移的完整过程。项目包含42个页面、187个组件,改造后首屏渲染时间从2.3s降至1.1s,组件重渲染次数减少63%。文中给出了具体的版本选型、迁移步骤、性能对比数据,以及我在迁移过程中遇到的5个典型坑位。
还在为命令行界面(CLI)的丑陋而烦恼吗?本文将深度推荐一个GitHub上爆火的开源项目——Bubble Tea。它基于Go语言,借鉴了Elm架构,让你能像写Web组件一样构建美观、响应式的终端用户界面。本文不仅会拆解其核心原理,还会手把手教你用200行代码实现一个实时交互的待办事项应用。
从LangChain到AutoGPT,AI Agent框架百花齐放但坑也不少。本文深入拆解四大主流框架的设计哲学、核心差异与落地踩坑经验,配合真实代码案例,帮你找到最适合自己项目的Agent方案。