asyncio重构Flask接口,QPS从120飙升到850的完整记录
一个内部报表接口因串行调用三次外部HTTP服务,高峰期平均延迟2.8秒,F5健康检查频繁超时。用asyncio搭配aiohttp重写后,在Python 3.8.10、单机4核8G环境下,接口P95延迟从3100ms降至420ms,QPS从120提升至850,CPU峰值反而下降15%。本文记录了从同步到异步的完整改造过程,包括Semaphore限流、超时控制、连接池复用等关键细节,以及两个隐藏极深的

专注于AI应用开发的工程化与业务落地。持续实践数据治理与评测、智能体工作流设计,重点关注效果、成本、稳定性和可维护性,分享经过验证的方案与真实复盘。
一个内部报表接口因串行调用三次外部HTTP服务,高峰期平均延迟2.8秒,F5健康检查频繁超时。用asyncio搭配aiohttp重写后,在Python 3.8.10、单机4核8G环境下,接口P95延迟从3100ms降至420ms,QPS从120提升至850,CPU峰值反而下降15%。本文记录了从同步到异步的完整改造过程,包括Semaphore限流、超时控制、连接池复用等关键细节,以及两个隐藏极深的
用一张3090显卡,花3小时微调开源7B模型,让它在特定指令任务上的准确率从68%提升到91%。本文将完整记录使用LoRA/QLoRA微调ChatGLM3-6B的过程,从数据清洗、训练配置、损失曲线分析到推理效果对比,包含可复现的代码和踩坑记录。不吹不黑,只看具体参数和实测数字。