智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
LoRA微调7B模型全记录:从QLoRA配置到loss收敛与推理效果对比

LoRA微调7B模型全记录:从QLoRA配置到loss收敛与推理效果对比

本文记录了一次完整的7B(7Billion)参数大模型微调实践,基于Qwen2.5-7B-Instruct,采用QLoRA(4-bit量化+LoRA)方案,在单卡A100-80G上完成训练。文章详细展示了从数据清洗、Prompt模板设计、训练超参(LoRA rank=64, alpha=128, lr=2e-4)到loss曲线(从2.3降至0.7)的全过程,并对比了微调前后模型在特定领域任务上的推

保持好奇服务器修炼册 265 63 0 14天前
asyncio重构Flask接口:QPS从320到1890的并发优化实录

asyncio重构Flask接口:QPS从320到1890的并发优化实录

某次线上监控发现,一个基于Flask的聚合查询API在高峰期P99延迟飙到2.8秒,单机QPS仅320。排查发现瓶颈不在数据库,而是阻塞式I/O调用——每次请求串行请求3个上游服务。我用asyncio+httpx重写核心调度层,并保留Flask作为Web框架(通过`asyncio.run`桥接),最终单机QPS提升至1890,P99延迟降到312ms。本文不聊理论,直接展示可运行的before/a

长期关注项目管理实践笔记 290 71 0 14天前
Docker Compose编排Nginx-Golang-PostgreSQL多服务容器化部署

Docker Compose编排Nginx-Golang-PostgreSQL多服务容器化部署

本文分享一个真实可运行的多服务docker-compose配置,涵盖Nginx 1.24反向代理、Golang 1.21 API服务、PostgreSQL 15数据库及Redis 7缓存,通过自定义网络隔离、命名卷持久化、healthcheck健康检查和depends_on条件控制启动顺序。配置实测在2C4G云主机上启动耗时43秒,内存占用稳定在512MB以内,适合中小型项目直接落地或二次改造。

清晨煮茶记 315 75 0 14天前
FastAPI与Flask性能对决:Profiling定位与多级缓存实战调优

FastAPI与Flask性能对决:Profiling定位与多级缓存实战调优

凌晨两点,线上API P95延迟飙升至2.3秒,数据库CPU打满100%。本文记录了一次完整的API性能调优过程:先用PySpy和cProfile定位瓶颈在N+1查询与JSON序列化,随后通过SQLAlchemy懒加载改造(查询次数从187次降至3次)和Redis多级缓存(命中率91%),最终P95延迟从2314ms降至287ms,吞吐量提升5.8倍。文章包含FastAPI与Flask的对比压测数

向内求解自动化成长记 255 54 0 14天前
Docker Compose编排多服务部署:网络、健康检查与启动顺序实践

Docker Compose编排多服务部署:网络、健康检查与启动顺序实践

生产环境容器化部署最头疼的就是服务启动顺序和依赖管理。本文基于Docker Compose 2.24 + Docker Engine 24.0,分享一个包含Nginx反向代理、Spring Boot应用、PostgreSQL和Redis的多服务编排方案。通过自定义网络隔离、healthcheck健康检查、depends_on条件控制,解决了服务启动竞态问题,将服务可用性从92%提升至99.5%,部

深巷做实验录 299 76 0 14天前
Prompt Engineering调优实录:实体抽取任务从52%到91%的Token效能跃升

Prompt Engineering调优实录:实体抽取任务从52%到91%的Token效能跃升

本文以电商评论实体抽取为靶场,对比零样本、Few-shot、CoT及Self-Consistency四种Prompt策略。实验基于GPT-4-turbo-preview(0125版),在200条真实评论上完成评测。通过结构化模板与动态示例注入,将F1值从0.52提升至0.91,单条Token成本从1.8K降至0.9K(降幅50%)。文中附完整代码与踩坑记录,揭示“示例质量>示例数量”的核心规律,并

持续研究品牌工作台 310 83 0 15天前
asyncio重构Flask接口,QPS从320到2100的完整记录

asyncio重构Flask接口,QPS从320到2100的完整记录

一个内部工单系统的列表接口,因为频繁查询外部监控API,平均耗时2.8秒,QPS只有320。我用asyncio把同步IO改成协程并发,配合semaphore限流,接口耗时降到420ms,QPS提升到2100。本文记录完整改造过程,包括asyncio与Flask的集成方式、信号量控制并发度、以及调试中遇到的Event Loop关闭异常。所有代码和压测数据均来自真实环境,Python 3.10.12,

阿南Dev手记 286 77 0 15天前
FastAPI接口200ms→12ms:profile定位与三层缓存优化实录

FastAPI接口200ms→12ms:profile定位与三层缓存优化实录

一个订单查询接口从215ms压测均值降至12.8ms,吞吐量从46 req/s提升至780 req/s。本文记录完整的优化链路:先用py-spy和cProfile定位到90%耗时在N+1查询与JSON序列化,再通过SQLAlchemy 2.0的selectinload合并查询,最后叠加Redis缓存与ORJSON响应模型。包含FastAPI 0.115与SQLAlchemy 2.0.36的具体配置

认真做创新拆解所 302 66 0 15天前
LangChain 0.3手写AI Agent:工具调用与记忆回环的12个坑

LangChain 0.3手写AI Agent:工具调用与记忆回环的12个坑

当 AutoGPT 的自主循环在真实业务中失控时,我决定用 LangChain 0.3.7 手写一个 200 行内的 Agent 内核。本文记录了一个支持 3 种自定义工具、滑动窗口记忆、异常熔断的 Agent 实现全过程。从工具描述 Token 膨胀导致的 47% 调用失败率,到记忆窗口 8 轮后准确率下降 23% 的实测数据,最终通过结构化工具定义和向量记忆压缩将单轮响应时间稳定在 1.8s。

认真做商业随身笔记 243 63 0 15天前
LangChain与AutoGPT启发下手写AI Agent循环控制与记忆管理实践

LangChain与AutoGPT启发下手写AI Agent循环控制与记忆管理实践

当AutoGPT的自动任务分解在真实业务中频繁因Token超限和工具调用死循环而崩溃时,我决定用LangChain的底层组件手写一个轻量Agent。本文记录了从零实现一个支持工具定义、短期记忆窗口、异常自动降级和循环次数硬限制的Agent全过程。实测在10轮对话内,相比直接调用OpenAI函数调用,工具选择准确率从72%提升至91%,Token消耗降低约38%。代码基于Python 3.10、La

大模型案例库 278 73 0 15天前
GitFlow与TrunkBased混合策略:支撑百人团队每日百次合并的版本控制方案

GitFlow与TrunkBased混合策略:支撑百人团队每日百次合并的版本控制方案

当团队从20人扩张到120人,原有单一主干分支策略导致发布前代码冻结长达3天,紧急修复频繁污染特性分支。我们结合GitFlow与TrunkBased设计了一套混合工作流,通过分支命名规范、自动化的Code Review门禁(基于GitLab 15.8+Merge Request Approvals)以及Jenkins Pipeline(2.4.3)的CI/CD集成,将发布周期从周缩短到天,线上缺陷

一只萤火虫收集工具日记 238 64 0 15天前
Git工作流重构记:分支策略与CI/CD流水线的一次落地实践

Git工作流重构记:分支策略与CI/CD流水线的一次落地实践

三个月前,我们的团队还在为“代码又冲突了”“谁把测试分支搞坏了”而焦头烂额。在将Git工作流从“自由发挥”重构为“GitFlow+PR强制+CI/CD门禁”后,线上故障率下降了约40%,功能分支平均存活时间从4.2天缩短至1.8天。本文不聊虚的,直接给出我们最终敲定的分支策略、基于GitLab的Code Review流程,以及串联Jenkins与SonarQube的流水线配置。文中所有yaml和s

推理加速研究笔记 349 77 0 15天前
React 19与Vue 3.5跨框架迁移:从Props钻取到Zustand/Pinia的工程化改造

React 19与Vue 3.5跨框架迁移:从Props钻取到Zustand/Pinia的工程化改造

本文记录了一个中后台项目从React 16 + Context向Zustand 4.5迁移,以及另一个Vue 3.2项目从Props钻取向Pinia 2.1迁移的完整过程。项目包含42个页面、187个组件,改造后首屏渲染时间从2.3s降至1.1s,组件重渲染次数减少63%。文中给出了具体的版本选型、迁移步骤、性能对比数据,以及我在迁移过程中遇到的5个典型坑位。

阿运维人手记 280 73 0 15天前
Git分支策略与CI/CD集成:携程机票团队3年工作流演进实录

Git分支策略与CI/CD集成:携程机票团队3年工作流演进实录

从2019年GitLab 12.5迁移到2022年GitLab 15.3,携程机票核心交易团队经历了从单主干到TrunkBased+环境分支的3次工作流重构。本文记录了我们在120人规模团队下,如何通过GitFlow变体解决发布零回滚、CodeReview效率提升40%、CI构建时间从22分钟压至6分30秒的真实踩坑过程。包含完整的`.gitlab-ci.yml`配置、分支保护规则脚本,以及我们如

小禾Coder手记 300 75 0 15天前
asyncio重构Flask接口:QPS从327到1892的并发优化实录

asyncio重构Flask接口:QPS从327到1892的并发优化实录

某电商订单系统的`/api/orders/summary`接口,因串行调用用户服务、商品服务、优惠券服务,P99延迟高达2.8秒,单机QPS仅327。本文基于Python 3.10 + asyncio + aiohttp,在不改变服务架构的前提下,将三次HTTP调用改为并发协程,配合`asyncio.Semaphore`控制连接池水位,最终P99降至410ms,QPS提升至1892(提升约4.8倍

一线自动化小站 259 64 0 15天前
Python异步编程:用asyncio重构Flask接口,QPS翻3倍

Python异步编程:用asyncio重构Flask接口,QPS翻3倍

一个用户画像查询接口,平均耗时从480ms降到160ms,QPS从210提升到680。本文记录我用asyncio+httpx改造Flask同步调用的全过程,包含完整代码对比、信号量并发控制、以及Connection Reset踩坑记录。适合被同步IO卡住瓶颈、想优化API性能但不想换框架的开发者。

业余开源爱好者 274 74 0 15天前
Milvus与Qdrant选型实录:亿级向量下的部署与性能对决

Milvus与Qdrant选型实录:亿级向量下的部署与性能对决

在电商以图搜图业务中,我们对比了Milvus 2.4.1与Qdrant 1.9.2的实测表现。同样在16C32G单机、ResNet50提取的768维向量、5000万规模下,Qdrant的RPS(每秒查询数)达到312,是Milvus的1.6倍;而Milvus的索引构建时间为2小时17分,比Qdrant快38%。内存占用方面,Milvus稳定在24GB,Qdrant则波动于19-27GB。本文将从部

数据库别催的程序员 349 79 0 15天前
用asyncio重构Flask接口,QPS从120飙升到850的完整记录

用asyncio重构Flask接口,QPS从120飙升到850的完整记录

一个内部报表服务,单个聚合接口需要同时调用3个下游RPC服务,平均响应时间1.2秒,压测QPS只有120。在不动数据库表结构、不改调用协议的前提下,我用asyncio+httpx把串行IO改成并发IO,部署后实测P95延迟从2.1秒降到380毫秒,QPS稳定在850。本文记录完整改造过程,包括信号量限流、超时控制、以及一个差点让我回滚的坑。

持续学习的数据人 307 79 0 15天前
告别Provider嵌套地狱:React 18与Vue 3项目迁移Zustand/Pinia状态管理全记录

告别Provider嵌套地狱:React 18与Vue 3项目迁移Zustand/Pinia状态管理全记录

本文记录了一个中后台项目从React 18 Context + useReducer与Vue 3 Props/emit混合架构,逐步迁移至Zustand 4.4与Pinia 2.1的真实过程。项目包含12个全局共享模块、48个页面组件,迁移后首屏渲染时间下降23%(从2.8s降至2.1s),组件重渲染次数减少约3800次/分钟,代码量缩减22%。文章将对比两种方案的性能差异,给出具体的迁移步骤与踩

微光种树录 328 89 0 15天前
Prompt Engineering实测对比:3模板调优让GPT-4输出质量提升67%

Prompt Engineering实测对比:3模板调优让GPT-4输出质量提升67%

本文基于OpenAI GPT-4-turbo(1106-preview)对“电商评论多维度情感分析”任务进行Prompt实验。通过对比零样本、少样本与结构化指令三种模板,在相同1000条真实评论下,结构化指令将F1分数从0.52提升至0.87,token消耗仅增加14.3%。文章详细记录了每个迭代的Prompt设计、API调用参数(temperature=0.2, max_tokens=512)及

深夜云原生笔记 304 73 0 16天前
上一页 1 2 3 ... 8 9 10 ... 26 27 28 下一页

作者推荐