智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
asyncio重构Flask接口,QPS从120飙到850的完整记录

asyncio重构Flask接口,QPS从120飙到850的完整记录

本文记录了一次真实的Web API性能优化过程。一个基于Flask 2.2.5的同步商品详情聚合接口,因串行调用3个上游HTTP服务(库存、价格、评价),平均响应时间高达210ms,压测QPS仅120。通过引入Python 3.10内置的asyncio + aiohttp 3.8.4,将串行IO改为并发协程,配合`asyncio.Semaphore`控制并发度,接口响应时间降至32ms,QPS提升

每天进步一点产品成长记 296 78 0 18天前
Prompt工程调优实录:从42%到87%准确率的三轮迭代实验

Prompt工程调优实录:从42%到87%准确率的三轮迭代实验

在实体关系抽取任务中,我通过三轮Prompt工程迭代,将F1分数从0.42提升至0.87,token消耗降低31%。本文记录了从零样本、少样本到结构化输出的完整实验过程,包含12组对比数据、3个关键代码片段和2个致命坑点。使用GPT-4-turbo-0125-preview,温度0.3,输出限制512 tokens。如果你正在为业务设计稳定的推理链路,这篇文章能帮你少走至少两周弯路。

长期关注战略增长记 392 86 0 18天前
向量数据库选型:Milvus与Qdrant在图像检索场景下的实测对比

向量数据库选型:Milvus与Qdrant在图像检索场景下的实测对比

在电商以图搜图业务中,我们对比了Milvus 2.4.1与Qdrant 1.9.0的部署复杂度、查询性能与资源占用。实测500万条768维向量,Qdrant在32核64G机器上P99延迟8ms,Milvus为12ms;但Milvus在批量写入吞吐上领先40%。内存占用方面,Qdrant的mmap模式比Milvus低35%。本文给出完整部署命令、Python压测脚本及调参细节,帮你避开我们踩过的坑。

周末写作小站 361 94 0 18天前
React 19与Vue 3.5跨框架状态管理迁移实录:从Prop Drilling到Zustand/Pinia

React 19与Vue 3.5跨框架状态管理迁移实录:从Prop Drilling到Zustand/Pinia

当项目从12个页面膨胀到47个页面,Context API的re-render风暴让首屏渲染时间从1.2s恶化到3.8s。本文记录了一个真实后台项目从Props/Context向Zustand 4.5与Pinia 2.1迁移的完整历程:对比三种方案的性能差异(TTI下降42%)、展示核心迁移工具函数、分享如何用React Compiler与Vue Reactive的边界处理技巧。文中所有版本号、性

终身学习写作成长记 316 80 0 18天前
FastAPI接口耗时458ms降到39ms:profile定位与三层缓存实战

FastAPI接口耗时458ms降到39ms:profile定位与三层缓存实战

生产环境一个订单查询接口,压测P95耗时从458ms飙到912ms,数据库CPU直接打满。本文记录一次完整的API性能调优过程:先用cProfile和py-spy定位到90%时间浪费在N+1查询和重复计算上,然后通过SQLAlchemy联合查询、Redis二级缓存、LRU本地缓存三层优化,最终P95降至39ms,吞吐量从320 req/s提升到2100 req/s。文中提供完整可运行的代码示例和压

云端河狸收集工具日记 358 94 0 18天前
FastAPI接口从800ms到80ms:Profiling与缓存策略全记录

FastAPI接口从800ms到80ms:Profiling与缓存策略全记录

本文记录了一个真实API服务的性能调优全过程。该服务基于FastAPI 0.104 + SQLAlchemy 2.0 + PostgreSQL 15,核心接口`/api/v1/orders/summary`在压测中P95延迟高达780ms,QPS仅为220。通过cProfile定位到瓶颈为N+1查询与ORM反射开销,随后采用`selectinload`预加载、Redis 7缓存热点数据、以及PGO

实战派Agent探索频道 329 92 0 18天前
Prompt编排四阶降本法:从12K到1.8K tokens的指令压缩实践

Prompt编排四阶降本法:从12K到1.8K tokens的指令压缩实践

同样的信息抽取任务,我用LangChain+GPT-4o-mini跑了三轮Prompt迭代。第一版冗余指令导致单次调用消耗12,386 tokens,且关键字段F1仅0.82;通过结构重排、思维链裁剪和少样本精简,最终将输入压缩至1,842 tokens,耗时从2.1s降到0.7s,F1提升至0.91。文中记录了每轮迭代的完整Prompt文本、token计费明细和回退陷阱,附可运行代码。

小林_LinuxLab 332 91 0 18天前
Docker Compose编排多服务容器化部署:网络卷挂载与健康检查实践

Docker Compose编排多服务容器化部署:网络卷挂载与健康检查实践

本文基于Docker Compose 2.24 + Docker Engine 24.0,分享一个生产级多服务(Nginx + Spring Boot + PostgreSQL + Redis)的编排配置。重点展示如何通过自定义网络实现服务隔离、命名卷持久化数据、healthcheck健康检查控制启动顺序,以及如何解决容器启动竞态问题。配置在4核8G机器上实测,服务启动时间从串行400秒缩短至并行

终身学习写作学习者 326 83 0 18天前
RAG命中率从61%到89%:chunk重构与rerank双阶段调优实录

RAG命中率从61%到89%:chunk重构与rerank双阶段调优实录

两个月前,我们基于LlamaIndex搭建的RAG问答系统在内部知识库上命中率仅有61%,Top-5召回准确率惨不忍睹。经过对chunk策略的反复试验(从固定256字到语义段落切分)、Embedding模型从`text2vec-large-chinese`切换到`bge-large-zh-v1.5`,以及引入`bge-reranker-base`进行精排,最终将Hit Rate提升至89%,MRR

小白DevLab 308 76 0 18天前
Git工作流重构记:分支策略与CI/CD集成调优全程

Git工作流重构记:分支策略与CI/CD集成调优全程

从SVN迁移到Git后,我们团队曾因混乱的分支模型导致每周平均2.3次误合并,发布前Code Review形同虚设。本文记录了我们基于Git 2.39.1重构工作流的全过程:采用Trunk-based Development + 短生命周期特性分支,引入GitHub Flow的PR机制,结合Jenkins Pipeline 2.44实现自动化门禁。最终将代码集成周期从2天缩短至4小时,线上事故率下

北岸煮茶 344 84 0 18天前
Milvus 2.4与Qdrant 1.9向量检索对决:千万级数据实测

Milvus 2.4与Qdrant 1.9向量检索对决:千万级数据实测

在电商以图搜图业务中,我们对比了Milvus 2.4.1与Qdrant 1.9.2的部署复杂度、查询性能与资源占用。使用7台物理机(6核32G)部署集群,测试1000万条768维向量。实测结果:Qdrant单机QPS达3200(P99=38ms),Milvus集群QPS为2800(P99=45ms),但Milvus在过滤查询(标量+向量混合)场景下延迟更低。内存占用方面Qdrant比Milvus少

发布又出问题求生记 430 100 0 18天前
FastAPI接口从800ms到60ms:Profile、SQL优化与Redis三级缓存实践

FastAPI接口从800ms到60ms:Profile、SQL优化与Redis三级缓存实践

一个电商订单聚合接口,QPS 200时P99延迟飙到800ms,CPU空转但DB负载打满。本文记录完整调优过程:先用cProfile和py-spy定位到N+1查询和JSON序列化热点,再通过SQLAlchemy 2.0的selectinload批量加载、索引覆盖以及Redis三级缓存策略,最终将P99降至62ms,QPS稳定在1200+。文中包含可复用的profiling脚本和缓存失效方案,以及压

长期主义商业学习者 423 101 0 18天前
向量数据库选型实录:Milvus与Qdrant在图像检索场景下的性能对决

向量数据库选型实录:Milvus与Qdrant在图像检索场景下的性能对决

本文基于一个真实的服装图像检索业务,在8核16G内存的物理机上对Milvus 2.3.3和Qdrant 1.7.3进行了全流程对比。从Docker部署、Python客户端写入500万条128维向量,到混合查询(向量+标量过滤)的P99延迟和召回率,再到内存/磁盘占用实测数据,完整呈现两个系统的优劣。结论:Qdrant在资源占用上仅为Milvus的40%,但Milvus的标量过滤能力和集群扩展性更胜

有点困的Go玩家 418 98 0 19天前
asyncio重构Flask接口,QPS从120到850的完整改造记录

asyncio重构Flask接口,QPS从120到850的完整改造记录

一个内部报表API,平均响应时间380ms,QPS卡在120上不去。数据库查询没问题,纯CPU计算密集,GIL锁成了瓶颈。用asyncio + uvloop替换了原来的多线程方案,配合aiohttp纯异步客户端,最终QPS稳定在850左右,P99延迟从520ms降到180ms。这篇文章记录了整个改造过程,包括asyncio.Semaphore控制并发、loop.run_in_executor规避阻

小林DockerLab 363 88 0 19天前
Prompt工程化调优实录:实体抽取任务的Token成本与输出质量权衡

Prompt工程化调优实录:实体抽取任务的Token成本与输出质量权衡

在Llama-3-8B-Instruct-4bit上对司法文书实体抽取任务做了12组Prompt对比实验。零样本模板F1仅62.3%,通过角色约束+输出JSON Schema+少样本示例,F1提升至84.7%,但Token消耗从每案412增至1893。最终用动态示例选择策略,将F1稳定在83.1%,Token压缩至772。本文记录了完整的调优路径、踩坑点(如JSON解析失败率从31%降至2.7%)

认真做内容增长记 398 101 0 19天前
Docker Compose编排生产级多服务:网络隔离、健康检查与启动顺序实践

Docker Compose编排生产级多服务:网络隔离、健康检查与启动顺序实践

本文基于Docker Compose v2.24.2,完整拆解一个包含Nginx网关、Spring Boot 3.2应用、PostgreSQL 15与Redis 7的四服务编排方案。通过自定义bridge网络实现前后端隔离,利用volume持久化数据库与缓存数据,配置TCP/HTTP双重健康检查,并借助depends_on条件与init容器解决服务启动竞态问题。部署后实测冷启动时间从手动部署的4分

企业级模型部署实践者 383 89 0 19天前
LangChain与AutoGPT双引擎:手写AI Agent循环控制与记忆管理

LangChain与AutoGPT双引擎:手写AI Agent循环控制与记忆管理

本文不讨论LangChain框架的表面封装,而是深入其AgentExecutor源码与AutoGPT的Plan-and-Execute模式,手写一个具备工具调用、短期/长期记忆、异常恢复机制的最小Agent。我们将用LangChain 0.1.0 + Python 3.11实现一个能自主完成“查询数据库→调用API→生成报告”的Agent,并对比AutoGPT的循环控制差异。实测在单轮任务中,自定

周末职场案例库 351 88 0 19天前
告别Prop Drilling:React 18与Vue 3项目迁移Zustand/Pinia的工程化记录

告别Prop Drilling:React 18与Vue 3项目迁移Zustand/Pinia的工程化记录

本文记录了在三个中型项目(React 18 + TS、Vue 3 + `<script setup>`)中,将全局状态从Context/Props逐层透传迁移至Zustand v4.4与Pinia v2.1的完整过程。对比了两种方案的性能差异:迁移后React项目首屏渲染时间从2.1s降至1.2s,组件重渲染次数减少67%;Vue项目Devtools中状态追踪时间减少40%。详细说明了迁移的6个步

深夜数据库学习簿 388 92 0 19天前
FastAPI与Flask性能对决:Profiling到缓存的全链路调优实录

FastAPI与Flask性能对决:Profiling到缓存的全链路调优实录

在一次高并发订单查询接口压测中,FastAPI版本QPS仅1800,Flask版本更是只有650。通过cProfile与Py-Spy定位到N+1查询和JSON序列化两大瓶颈,配合SQLAlchemy懒加载优化、Redis缓存热点数据以及异步改造,最终FastAPI接口QPS提升至9200,Flask提升至4100。本文完整记录调优思路、工具使用细节与踩坑过程,包含可复现的代码片段和压测数据对比。

稳步前行自动化学习者 382 97 0 19天前
asyncio重构Flask接口:Web API并发性能提升5.7倍的完整记录

asyncio重构Flask接口:Web API并发性能提升5.7倍的完整记录

上周优化一个内部数据看板服务,发现其聚合接口在300并发下P95延迟高达2.3秒,数据库连接池被占满。我用asyncio+httpx重写了核心调用链,将串行IO等待改为协程并发,并针对Python 3.11的asyncio机制做了三个关键调优。最终P95降至0.4秒,吞吐量从180 RPS提升到1030 RPS。本文记录完整的重构思路、踩坑过程和性能对比数据,包括event loop策略选择、超时

一线开源说明书 301 75 0 19天前
上一页 1 2 3 ... 10 11 12 ... 24 25 26 下一页

作者推荐