智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
企业级大模型落地指南

企业级大模型落地指南

Lv.1

专注于大模型应用的工程化与业务落地。持续实践AI应用的成本与稳定性、数据治理与评测,重点关注效果、成本、稳定性和可维护性,分享经过验证的方案与真实复盘。

3文章
0粉丝
0关注
8获赞
⌖ 广东 · 东莞 ▣ 加入时间:2026-04-11

最新文章

asyncio重构Flask接口,QPS从120飙到850的详细记录

一个内部报表API,单次查询需聚合3个微服务数据,平均耗时1.2秒,压测QPS仅120。我用asyncio+httpx将其重构为并发IO后,P95延迟从2.1s降到380ms,QPS稳定在850。本文记录从同步阻塞到异步非阻塞的完整改造过程,包含asyncio.Semaphore限流、超时控制、Python 3.11的asyncio.TaskGroup用法,以及一个差点导致连接池耗尽的坑。

RAG召回率从61%到89%:chunk重构、Embedding选型与Rerank排错全记录

线上问答系统在迁移到新知识库后,召回率骤降至61%,Top-20命中率不足七成。本文记录了完整的RAG调优链路:从固定256字chunk改为按Markdown标题与段落语义切分,将bge-large-zh替换为bge-m3(支持多向量与长文本);随后引入bge-reranker-v2-m3做两阶段重排,并修复了混合检索权重错误。最终在自建500道评测集上,Hit@5从61.3%提升至89.2%,平