智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
Python异步编程:asyncio重构Flask接口吞吐量提升3.2倍

Python异步编程:asyncio重构Flask接口吞吐量提升3.2倍

在一次电商大促压测中,我发现某个订单查询接口在QPS达到200时RT飙升至2.8s,而数据库负载却不足30%。通过引入asyncio+httpx将串行RPC调用改为并发协程,接口吞吐量从320 QPS提升至1024 QPS,P99延迟从1.2s降至380ms。本文记录了完整的重构过程,包括asyncio.Semaphore限流、aiohttp连接池调优、以及uvloop替换事件循环的实测数据。踩坑

任务别再改了求生记 178 39 0 10天前
React 19与Vue 3.5下从Props钻取到Zustand与Pinia的状态重构实录

React 19与Vue 3.5下从Props钻取到Zustand与Pinia的状态重构实录

在维护一个拥有87个路由页面、42个共享业务模块的中后台系统时,props钻取导致的无效渲染让我在Chrome Performance面板里看到了单次交互触发31次组件重渲染的窘境。本文记录了从React 19的Context/Props方案迁移至Zustand v5,以及Vue 3.5项目迁移至Pinia v3的完整过程。包括迁移前后的bundle体积对比(React项目减少18KB,Vue项目

长期主义数据库学习者 287 54 0 10天前
FastAPI接口耗时400ms优化到45ms:Profiling与缓存策略全记录

FastAPI接口耗时400ms优化到45ms:Profiling与缓存策略全记录

一个内部报表API在QPS 200时P95延迟飙至380ms,数据库CPU被打满。本文记录了从Profiling定位(cProfile+py-spy)、SQLAlchemy N+1查询治理、多级缓存(Redis+本地Cache)到最终P95降至48ms、CPU占用降72%的完整过程。包含FastAPI 0.115与SQLAlchemy 2.0的实操代码与压测数据对比,踩坑细节同步给出。

北岸读书集 268 64 0 10天前
Git分支策略与Code Review流水线:支撑百人研发团队的协作体系

Git分支策略与Code Review流水线:支撑百人研发团队的协作体系

当团队从20人扩张到120人,主干开发模式引发的代码冲突、发布事故呈指数级增长。本文基于Git 2.39.1与GitLab 15.11,落地了一套融合Trunk-Based与GitFlow优点的混合分支策略,配合基于Merge Request的强制Code Review流水线(含Prettier、ESLint、Jest自动化门禁),将平均代码评审等待时间从4.2小时降至1.1小时,线上事故率降低7

暮色漫游集 228 53 0 10天前
asyncio重构Flask接口:并发等待减300%,QPS翻4倍全程记录

asyncio重构Flask接口:并发等待减300%,QPS翻4倍全程记录

一个内部报表API,单次请求需聚合4个外部服务数据,平均耗时820ms,高峰期Tomcat线程池被打满。用asyncio + aiohttp重写后,P95延迟从1.2s降到280ms,QPS从120升到480。本文记录完整重构过程:从同步阻塞到事件循环,包含asyncio.Semaphore限流、连接池复用、超时控制三个关键优化点,并给出具体压测数据与Python 3.10下的踩坑解决方案。

一线开源说明书 240 52 0 10天前
FastAPI×Flask双框架API性能调优:cProfile定位与Redis缓存实战

FastAPI×Flask双框架API性能调优:cProfile定位与Redis缓存实战

一个生产环境接口从平均响应1800ms压到220ms,P99从4.2s降到380ms,数据库QPS从1200降至150,CPU占用降低40%。本文基于FastAPI(0.104.1)与Flask(3.0.0)双框架对比实验,完整记录了性能瓶颈的定位过程:先用cProfile和py-spy揪出隐藏的N+1查询与序列化开销,再通过SQLAlchemy(2.0.25)的`selectinload`策略和

需求先跑起来观察员 246 56 0 10天前
React 19与Vue 3.5下从Context到Zustand/Pinia的状态重构实录

React 19与Vue 3.5下从Context到Zustand/Pinia的状态重构实录

我的后台管理系统在列表页频繁操作时,Context导致的全局重渲染让性能面板飙红到120ms。本文记录从React 19的Context+useReducer迁移至Zustand 5,以及Vue 3.5的provide/inject迁移至Pinia 3的完整过程。包含两种框架的迁移对照、代码差异、以及迁移后FCP提升42%、交互响应时间从87ms降至23ms的具体优化数据。

云端河狸正在学习 222 62 0 10天前
asyncio重构Flask API:并发等待缩短至1.2秒,性能提升8倍

asyncio重构Flask API:并发等待缩短至1.2秒,性能提升8倍

一个基于Flask 2.0 + Requests库的聚合API,因串行调用3个上游HTTP服务而达到9.8秒的P95延迟。通过引入asyncio + aiohttp 3.8,将阻塞式IO替换为事件循环驱动的协程,在保持接口签名不变的前提下,将P95延迟降至1.2秒,吞吐量从120 QPS提升至960 QPS。本文记录了从同步到异步的完整改造过程,包括Semaphore限流、超时控制、连接池复用等生

队列等待重构求生记 199 47 0 11天前
React 19与Vue 3.5下从Props钻取到Zustand/Pinia:迁移实录与性能对比

React 19与Vue 3.5下从Props钻取到Zustand/Pinia:迁移实录与性能对比

在支撑日均百万请求的中后台项目中,Props drilling和Context泛滥导致组件重渲染次数激增37%,首屏交互延迟达220ms。本文记录了将React 19.1与Vue 3.5双技术栈项目从原生状态传递迁移至Zustand 5.0与Pinia 3.0的全过程。通过6个关键步骤、3个可运行代码块,对比了迁移前后组件树渲染耗时(由18ms降至6.2ms)、内存占用(下降28%)及代码维护成本

喜欢复盘的算法人日常 150 43 0 11天前
asyncio重构Flask接口:QPS从120到1850的并发优化实录

asyncio重构Flask接口:QPS从120到1850的并发优化实录

某次压测发现一个调用第三方REST API的Flask服务,在50并发下QPS仅120,平均延迟420ms,大量请求阻塞在`requests`库的同步IO上。本文通过`asyncio` + `aiohttp` + `uvloop`重构该接口,将同步阻塞改为异步非阻塞,配合`asyncio.Semaphore`控制并发上限,最终QPS提升至1850,P99延迟从800ms降至210ms。文中提供完整

任务别再改了求生记 232 58 0 11天前
LangChain+AutoGPT思想重构:手写AI Agent核心循环控制机制

LangChain+AutoGPT思想重构:手写AI Agent核心循环控制机制

当LangChain v0.2.2的AgentExecutor在复杂任务中频繁陷入死循环、记忆混乱时,我决定基于AutoGPT的"计划-执行-反思"范式,从零手写一个仅需287行代码的Agent核心。本文不讨论框架API,而是深入工具注册表设计、滑动窗口记忆管理、异常熔断机制以及最大迭代次数控制。实测在百度百科问答任务中,手写版相比LangChain原生Agent,token消耗减少43%,任务完

阿机器学习玩家日常 190 51 0 11天前
FastAPI慢查询优化实录:Profiling定位到缓存设计压测对比

FastAPI慢查询优化实录:Profiling定位到缓存设计压测对比

在一次内部服务重构中,我们的FastAPI接口(Python 3.10 + FastAPI 0.95 + SQLAlchemy 2.0)在压测时发现`GET /api/v1/products`接口P99延迟高达2.8秒,TPS仅能维持在180。通过cProfile定位到瓶颈是N+1查询和模板渲染,随后引入`selectinload`批量加载并加了一层Redis缓存,最终P99降至120ms,TPS

周末智能体进阶录 239 61 0 11天前
React 19与Vue 3.5状态管理迁移实录:从Props钻透到Zustand/Pinia

React 19与Vue 3.5状态管理迁移实录:从Props钻透到Zustand/Pinia

在维护一个3万行代码的中台项目时,我们因Props层层透传和Context频繁重渲染导致页面卡顿——首屏渲染时间从1.2s恶化到2.8s,组件更新时CPU占用飙升至80%。本文记录我们将React 19与Vue 3.5双技术栈项目从本地State/Context迁移至Zustand 5和Pinia 3的全过程:包含方案选型对比(含性能基准测试数据)、分步迁移策略(细粒度状态切片)、以及迁移后渲染次

每天进步一点商业成长记 285 66 0 11天前
Prompt Engineering调优实录:从38%到91%准确率的NER任务迭代

Prompt Engineering调优实录:从38%到91%准确率的NER任务迭代

本文记录了一次针对中文命名实体识别(NER)任务的Prompt工程完整实验。通过设计5种不同结构的Prompt模板,在GPT-3.5-turbo(gpt-3.5-turbo-0613)上进行了总计120次API调用,对比了零样本、少样本、思维链(CoT)及角色扮演等策略。实验数据显示,采用“角色定义+格式约束+两步推理”的混合Prompt,将F1值从基线0.38提升至0.91,同时将单次token

阿航_Lab 272 60 0 11天前
asyncio重构Flask接口:Web API响应时间从820ms降至96ms

asyncio重构Flask接口:Web API响应时间从820ms降至96ms

在一次电商大促压测中,我发现某个聚合商品详情的API接口平均响应时间高达820ms,P99更是突破2.1秒。通过引入Python 3.10的asyncio原生协程,搭配aiohttp与asyncpg替换同步requests和psycopg2,对三个下游服务(商品服务、库存服务、促销服务)做并行IO调度,最终将P50响应时间降至96ms,P99控制在280ms以内。本文将完整复盘这次性能优化的全过程

狐狸研究AI日记 222 51 0 11天前
7B模型LoRA/QLoRA微调实录:显存从24G降到8G与效果对比

7B模型LoRA/QLoRA微调实录:显存从24G降到8G与效果对比

本文记录了一次完整的LLM微调实践,使用LoRA与QLoRA技术对Qwen2-7B-Instruct模型进行领域适配。通过4-bit NF4量化+双LoRA适配器,将峰值显存从全参数微调的24GB+压缩至8.2GB,训练速度仅下降约18%。文章详细对比了LoRA(秩r=16)与QLoRA在相同数据下的loss收敛曲线及推理效果,发现QLoRA在F1指标上仅损失0.7%,却换来了三倍以上的显存节省。

阿洛_Dev手记 250 54 0 11天前
React 18与Vue 3项目从Props钻取到Zustand/Pinia:状态重构实录与性能对比

React 18与Vue 3项目从Props钻取到Zustand/Pinia:状态重构实录与性能对比

接手一个迭代两年的后台管理系统,600+组件,Props钻取导致30%组件为纯透传,Context滥用引发二次渲染风暴。本文记录将React 18项目迁移至Zustand v4.4,Vue 3项目迁移至Pinia v2.1的完整过程。包含方案选型对比(Redux/Zustand/Jotai vs Vuex/Pinia)、渐进式迁移策略、性能数据对比(迁移后首屏渲染时间从2.3s降至1.1s,内存占

长期主义架构学习者 238 53 0 11天前
Prompt编排四阶调优法:从12%到87%的准确率跃迁实录

Prompt编排四阶调优法:从12%到87%的准确率跃迁实录

针对“金融舆情实体关系抽取”任务,我通过四轮Prompt迭代(零样本→少样本→思维链→自洽性校验),将GPT-4o-mini的F1值从0.12提升至0.87。实验消耗约240万token(成本$4.2),记录了温度系数、系统提示词长度、示例格式对输出JSON结构稳定性的影响。文中提供可复现的Prompt模板与Python评测脚本,并披露了三个最隐蔽的坑:中文标点污染、数组嵌套丢失、以及“模型幻觉”

增长增长记 217 56 0 11天前
React 19与Vue 3.5状态管理迁移实录:从Props钻透到Zustand/Pinia的降载与收益

React 19与Vue 3.5状态管理迁移实录:从Props钻透到Zustand/Pinia的降载与收益

项目从Vue 2.6+Props钻透迁移至Vue 3.5+Pinia,同时React 18.3分支从Context+useReducer迁移至Zustand 4.5。迁移后首屏渲染时间从2.3s降至1.1s(-52%),组件重渲染次数减少约67%,代码量缩减32%。本文记录真实迁移决策过程,包括方案选型对比(Zustand vs Jotai vs Pinia vs Valtio)、渐进式迁移策略(

实战派推理加速应用札记 223 47 0 11天前
RAG召回率从61%到89%:chunk重构与embedding选型及rerank实战

RAG召回率从61%到89%:chunk重构与embedding选型及rerank实战

在构建企业知识库问答系统时,我们遭遇了严重的“检索幻觉”问题——回答看似流畅但引用错误频出。本文记录了从初始的固定512字符切块+`text2vec-large-chinese`方案,到动态语义切块+`bge-large-zh-v1.5`+`bge-reranker-v2-m3`的完整优化链路。实测在CMRC2018自建QA数据集上,Recall@5从61.3%提升至89.7%,幻觉率下降42%。

老陈Python手记 195 48 0 12天前
上一页 1 2 3 ... 5 6 7 ... 25 26 27 下一页

作者推荐