智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
FastAPI压测QPS从180到1600:Profile与查询缓存调优记

FastAPI压测QPS从180到1600:Profile与查询缓存调优记

一个真实业务接口,单次请求需聚合12张分表数据并执行复杂过滤,初始压测QPS仅180,P99延迟达2.1秒。通过cProfile与py-spy定位到CPU热点集中在SQLAlchemy ORM的逐行对象映射和N+1查询上;改用原生SQL + `fetchall()`后QPS提升至520;再引入Redis二级缓存(TTL 60s)与Gunicorn多Worker(4进程)后,最终QPS稳定在1600

一只萤火虫收集工具日记 199 49 0 12天前
告别Props钻透:React 18与Vue 3项目迁移Zustand/Pinia的完整记录

告别Props钻透:React 18与Vue 3项目迁移Zustand/Pinia的完整记录

当组件树超过5层,Context导致的无效渲染让首屏交互延迟从120ms飙升到480ms。本文记录了一个真实后台管理系统(React 18 + Vue 3双技术栈)从混合使用Props/Context迁移到Zustand 4.x与Pinia 2.x的全过程。通过对比迁移前后的渲染次数(React Profiler实测减少63%)和内存占用(Chrome DevTools Heap Snapshot

实战派LLM应用札记 247 56 0 12天前
LoRA微调7B模型显存从80G降到24G:我的QLoRA实践全记录

LoRA微调7B模型显存从80G降到24G:我的QLoRA实践全记录

我最近用QLoRA在单卡RTX 3090上微调了Chinese-LLaMA-7B,把显存峰值压到21.8G,训练速度稳定在1.2s/step。相比全量微调,显存直降72%,且推理时在C-Eval榜单上从39.8分提升到52.6分。本文记录完整实操:从数据清洗到PEFT配置,从loss曲线分析到生成效果对比,包括NF4量化下的数值稳定性坑和梯度检查点优化细节。

北岸读书集 250 55 0 12天前
asyncio重构Flask API:请求耗时从2.3秒降至480毫秒

asyncio重构Flask API:请求耗时从2.3秒降至480毫秒

一个内部报表接口因串行调用3个下游HTTP服务,P95延迟飙到2.3秒,生产环境频繁报警。我用asyncio + aiohttp重写核心IO逻辑,配合信号量限流和连接池复用,将P95降至480ms,吞吐量提升4.7倍。本文记录完整的重构过程、踩过的坑(包括隐式事件循环、线程安全、超时陷阱)以及最终的性能对比数据。如果你也在用Flask/Django写同步接口,这篇文章能帮你少走至少一周弯路。

知识管理手记 220 56 0 12天前
FastAPI与Flask性能对决:Profiling定位与缓存优化实测

FastAPI与Flask性能对决:Profiling定位与缓存优化实测

在一次内部API服务重构中,我发现一个基于Flask 2.2的订单查询接口在200并发下P95延迟高达1.8秒,吞吐量仅320 req/s。通过cProfile与py-spy定位到瓶颈在N+1查询和JSON序列化,随后用FastAPI 0.104重写并引入Redis缓存与SQLAlchemy 2.0的selectinload,最终将P95降至42ms,吞吐量提升至2100 req/s。本文记录完整

模型别催的开发者 253 62 0 12天前
GitFlow与三态分支策略:日均200次提交的团队协作实践

GitFlow与三态分支策略:日均200次提交的团队协作实践

当团队从5人扩张到25人,主干开发模式引发的代码冲突率飙升300%,发布事故频发。本文基于Git 2.39.1,落地了一套融合GitFlow与Trunk-Based的分支策略,通过`feature→develop→release→main`四级流转与`CODEOWNERS`强制Code Review,配合Jenkins Pipeline实现提交即构建、合并即部署。实践4个月后,分支集成冲突率下降6

保持好奇服务器修炼册 244 61 0 12天前
asyncio重构Flask接口:并发吞吐提升3.2倍的全记录

asyncio重构Flask接口:并发吞吐提升3.2倍的全记录

一个内部报表服务,单次请求需聚合4个上游HTTP接口数据,平均耗时480ms。用asyncio + aiohttp替换requests串行调用后,P95延迟从612ms降到189ms,QPS从92提升到296。全程记录依赖注入改造、信号量限流和Python 3.10 asyncio.run()的坑。文末附可运行代码,含asyncio.Semaphore(20)控制并发和aiohttp连接池复用参数

一只蜗牛研究AI日记 241 59 0 12天前
LangChain与AutoGPT思想融合:手写Agent循环控制与记忆管理实践

LangChain与AutoGPT思想融合:手写Agent循环控制与记忆管理实践

本文记录一次从零手写AI Agent的完整过程,不依赖LangChain的Agent封装,仅借助其Tool抽象与AutoGPT的“任务分解-自我反思”思想。实现了支持8种工具调用、基于Token的滚动记忆窗口(128轮对话)、三级异常降级策略的Agent核心。实测在API调用成本约0.02美元/任务的前提下,将多步工具任务的完成率从纯Prompt方案的67%提升至91%。重点分享工具定义Schem

认真成长运维修炼册 230 56 0 12天前
Docker Compose编排多服务依赖:网络卷健康检查与启动顺序全解析

Docker Compose编排多服务依赖:网络卷健康检查与启动顺序全解析

在一次电商后台重构中,我将原本散落在单机上的5个服务(Nginx、后端API、Redis、PostgreSQL、Celery Worker)迁移到Docker Compose编排,解决了服务启动顺序错乱、数据卷权限丢失、健康检查误判等6个问题。本文详细分享我的docker-compose.yml配置,包含自定义网络、命名卷、依赖健康检查(condition: service_healthy)及重启

一只熊猫偶尔重构日记 223 59 0 12天前
asyncio重构Flask接口:3行代码让QPS从200到1500

asyncio重构Flask接口:3行代码让QPS从200到1500

某次生产环境压测,一个内部报表接口QPS只有200,单次请求平均延迟450ms,数据库连接池被打满。排查发现80%时间浪费在串行调用三个下游HTTP服务上。我用asyncio对Flask应用做了最小化改造——仅新增3个异步代理函数,配合`gather`并发调用,QPS提升至1500,P99延迟从1.2s降到280ms。本文记录完整改造过程,包括asyncio与Flask同步视图的兼容方案、信号量限

一只安全研究员手记 262 59 0 12天前
Git分支策略与Code Review流水线:支撑200人协同的落地配置

Git分支策略与Code Review流水线:支撑200人协同的落地配置

当团队从20人扩张到200人,Git分支管理混乱导致的合并冲突和发布事故激增300%。本文基于Git 2.39.1和GitLab 15.11,分享一套经过生产验证的分支策略(Trunk-based + Release Branch)与Code Review强制流程。通过配置`merge request`的`approval rule`与`CI pipeline`的`rules`语法,将主干合并平均

持续迭代商业成长记 237 63 0 12天前
LangChain 0.3手写Agent:工具注册表与记忆衰减的12个工程细节

LangChain 0.3手写Agent:工具注册表与记忆衰减的12个工程细节

当AutoGPT的自主循环在复杂任务中频繁陷入死循环时,我决定用LangChain 0.3.7从零构建一个可控的ReAct Agent。本文记录了一个生产级Agent的核心骨架:通过工具注册表实现12个函数的动态调用,采用滑动窗口+遗忘曲线管理超过200条对话记忆,并设计了三层错误恢复机制。实测在金融问答数据集(500条样本)上,任务完成率从AutoGPT的68%提升至91%,平均迭代轮次从14.

小周_Go 226 48 0 12天前
FastAPI服务从800ms到90ms:Profiling与缓存策略全记录

FastAPI服务从800ms到90ms:Profiling与缓存策略全记录

一个内部报表接口,线上P95延迟从812ms降到96ms,吞吐量提升5.2倍。过程中使用了py-spy、cProfile、EXPLAIN ANALYZE等工具定位瓶颈,发现主要耗时不在SQL而在N+1查询与模板渲染。通过引入Redis缓存、查询合并、Pydantic序列化优化,最终将数据库连接数从峰值120降到35。本文记录完整调优路径、代码改动与压测数据,含FastAPI 0.104、Postg

飞鸟认真测试 257 63 0 12天前
Prompt Engineering在SQL生成任务中的调优实录:从42%到87%准确率

Prompt Engineering在SQL生成任务中的调优实录:从42%到87%准确率

本文记录了一次针对Text-to-SQL生成任务的Prompt调优全过程。通过5轮迭代实验,对比了零样本、Few-shot、思维链及角色扮演等7种Prompt模板,在Spider数据集子集上的表现。实验显示,引入格式约束与错误修复示例后,执行准确率从基线42.3%提升至87.1%,同时Token消耗仅增加18.6%。文中包含完整代码与各版本Prompt模板,以及一个关于“模型幻觉”的典型踩坑记录。

长期关注需求分析创作局 240 52 0 12天前
LangChain与AutoGPT思想融合:手写Agent核心循环与记忆机制

LangChain与AutoGPT思想融合:手写Agent核心循环与记忆机制

当AutoGPT的自主循环思想遇上LangChain的工具抽象,我实现了一个仅用300行代码的轻量级Agent,在电商客服场景下将多轮查询的处理时间从平均4.2秒降至1.8秒,工具调用准确率从82%提升至94%。本文将拆解这个简化版Agent的四大核心模块:工具定义如何规避LangChain的pydantic版本陷阱、基于堆栈的记忆管理如何替代昂贵的向量数据库、以及一个决定Agent生死存亡的错误

野生开发者日常 242 61 0 12天前
React 19与Vue 3.4下从Props钻取到Zustand 5与Pinia 2迁移实录

React 19与Vue 3.4下从Props钻取到Zustand 5与Pinia 2迁移实录

项目从React 19 + Vue 3.4混合架构中,将超过120个跨层级组件从Props/Context双向同步重构为Zustand 5.0.3与Pinia 2.2.8。重绘次数减少62%,交互延迟从平均8.3ms降至2.1ms,代码删除约3800行。文中记录具体的依赖注入陷阱、订阅失效场景以及性能对比数据。

文档正在自愈求生记 288 64 0 12天前
FastAPI服务压测3倍性能提升:Profile定位与缓存优化实录

FastAPI服务压测3倍性能提升:Profile定位与缓存优化实录

一个日请求量百万级的FastAPI服务,P95延迟从820ms飙升至2.3s。通过cProfile定位到N+1查询与JSON序列化两大瓶颈,配合SQLAlchemy 1.4的selectinload优化与Redis缓存,将P95降至340ms,吞吐量从280 req/s提升至960 req/s。本文记录完整的性能调优过程,包含Flask与FastAPI的对比实验数据与踩坑细节。

低调的工程师 239 55 0 12天前
7B模型LoRA/QLoRA微调全记录:从显存9.8G到推理速度提升41%

7B模型LoRA/QLoRA微调全记录:从显存9.8G到推理速度提升41%

本文记录了一次完整的7B模型微调实践,使用LoRA和QLoRA技术对Qwen2.5-7B-Instruct进行领域适配。在单张RTX 3090(24G显存)环境下,通过QLoRA将训练显存峰值控制在9.8G,微调后模型在医疗问答数据集上的ROUGE-L从0.21提升至0.47。同时对比了LoRA与QLoRA在训练速度、显存占用、推理效果上的差异,并给出了训练过程中遇到的3个典型坑及解决方案。

一只金鱼每天复盘日记 311 73 0 13天前
FastAPI压测4倍性能提升:Profiling与缓存策略全记录

FastAPI压测4倍性能提升:Profiling与缓存策略全记录

一个内部报表接口,单次请求耗时从860ms降至210ms,QPS从120提升至510。本文记录了完整的调优过程:先用cProfile和py-spy定位瓶颈在N+1查询与重复计算,再通过SQLAlchemy 2.0的`selectinload`合并查询,最后引入Redis缓存热点数据并处理缓存雪崩。包含FastAPI 0.104与SQLAlchemy 2.0.25环境下的完整代码、压测工具wrk的配

周末增长观察室 221 56 0 13天前
Docker Compose编排Nginx+Node.js+Redis多服务部署,网络卷健康检查全解析

Docker Compose编排Nginx+Node.js+Redis多服务部署,网络卷健康检查全解析

本文分享一个生产环境可用的docker-compose.yml配置,完整编排Nginx、Node.js(Express)、Redis三个服务。通过自定义bridge网络实现服务隔离,使用命名卷持久化Redis数据与Nginx日志,配置基于curl的healthcheck探针,并利用depends_on条件控制启动顺序。实测在2核4G服务器上,服务启动时间从手工部署的45秒缩短至12秒,容器重启策略

云端灰狼住在云端 219 51 0 13天前
上一页 1 2 3 ... 6 7 8 ... 25 26 27 下一页

作者推荐