asyncio重构Flask接口:QPS从120到850的完整记录
一个内部报表接口,单次查询耗时3.2秒,并发30时QPS仅120,CPU闲置率却高达70%。我用asyncio+httpx重写了核心IO逻辑,配合Semaphore限流和连接池复用,将P95延迟从2.8秒压到180毫秒,QPS提升至850。本文记录完整改造过程,包括asyncio.run和get_event_loop的坑、aiohttp连接池泄漏的排查、以及uvloop带来的额外30%收益。所有代

主要整理软件架构相关的学习笔记与工程经验,内容覆盖故障排查、工程架构。倾向用真实案例代替空泛结论,希望把复杂问题讲清楚、把实践步骤写完整。
一个内部报表接口,单次查询耗时3.2秒,并发30时QPS仅120,CPU闲置率却高达70%。我用asyncio+httpx重写了核心IO逻辑,配合Semaphore限流和连接池复用,将P95延迟从2.8秒压到180毫秒,QPS提升至850。本文记录完整改造过程,包括asyncio.run和get_event_loop的坑、aiohttp连接池泄漏的排查、以及uvloop带来的额外30%收益。所有代
在一次保险理赔实体抽取任务中,我通过四轮Prompt迭代,将GPT-4o-mini的F1分数从3.2%提升至41.7%,同时token消耗降低37%。本文记录了从零样本模板到结构化约束、从单一输出到多轮校验的完整过程,包含温度参数、system prompt分隔符、few-shot样本选择等细节对结果的影响。全文包含2个可复现代码块,所有实验数据基于OpenAI API 2024年8月版本。