智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
Docker Compose编排实践:多服务容器化部署的网络与健康检查配置

Docker Compose编排实践:多服务容器化部署的网络与健康检查配置

在一次电商后台重构中,我将5个服务(Nginx、后端API、Redis、PostgreSQL、Celery Worker)从手工docker run脚本迁移到Docker Compose编排。通过自定义网络、持久化卷挂载、健康检查和depends_on条件控制,最终实现服务启动时间从3分钟缩短到40秒,容器重启恢复时间降低80%。这篇文章将分享这套配置的完整细节,包括遇到的两个典型坑的解决方案,希

一线商业随想 256 73 0 13天前
React 19与Vue 3.5下从Context到Zustand/Pinia迁移实录:3倍渲染性能提升

React 19与Vue 3.5下从Context到Zustand/Pinia迁移实录:3倍渲染性能提升

在维护一个拥有200+路由、日均请求量50万次的中后台项目时,我遇到了 Context 导致的连锁渲染问题——一次无关的state更新竟触发了整棵组件树重绘,DevTools 显示最长帧耗时达 120ms。本文记录了从 React 19 的 useContext 和 Vue 3.5 的 provide/inject 迁移到 Zustand v5 与 Pinia v3 的完整过程,包括方案选型对比、

脚本保持在线的开发者 293 78 0 13天前
Git分支策略与CI/CD集成:300人团队流水线配置实录

Git分支策略与CI/CD集成:300人团队流水线配置实录

当50个功能分支同时涌向master,代码合并冲突平均耗时47分钟,CI构建排队超过2小时——这是我们团队在2023年遇到的真实困境。本文基于Git 2.39.1和GitLab 15.7,详细拆解了一套适配300人研发团队的Git工作流:从三线分支策略(master/staging/feature)到基于MR的强制Code Review流程,再到与Jenkins 2.387.1的流水线联动。文中提

深度学习落地指南 240 64 0 13天前
Milvus与Qdrant在亿级向量场景下的选型实测:从部署到查询延迟

Milvus与Qdrant在亿级向量场景下的选型实测:从部署到查询延迟

在高并发实时推荐业务中,向量数据库选型直接决定服务成本与响应速度。本文基于美团到店业务某推荐场景,使用同一份2500万条768维向量数据,分别对Milvus 2.4.1(CAGRA索引)和Qdrant 1.9.0(HNSW)进行完整对比。实测得出:在16C32G单机配置下,Qdrant内存占用比Milvus低37%,但Milvus在4并发下P99延迟低至12ms,且支持GPU加速。文章包含从Doc

一只金鱼每天复盘日记 220 51 0 13天前
Prompt Engineering实测:五轮迭代让GPT-4o输出准确率从62%升至91%

Prompt Engineering实测:五轮迭代让GPT-4o输出准确率从62%升至91%

本文以“电商评论情感分类”为具体任务,对比了零样本、少样本、思维链、结构化约束和角色扮演五种Prompt策略。实验基于GPT-4o(2025-05-13快照)和gpt-3.5-turbo-0125,共消耗约18万token,花费约$4.2。通过五轮迭代,我最终将分类F1值从0.62提升至0.91,同时把单次推理token开销从420压缩到280。文章不聊玄学,只贴代码和真实数字,包括每个Promp

需求持续优化的程序员 262 71 0 13天前
Prompt Engineering调优实录:基于GPT-4o的电商评论情感分类Token开销与精度权衡

Prompt Engineering调优实录:基于GPT-4o的电商评论情感分类Token开销与精度权衡

在电商评论情感分类任务中,我基于OpenAI GPT-4o(0613版本)设计了5组不同复杂度的Prompt,从零样本到带示例的思维链,对比了准确率、F1值、Token消耗与延迟。实验发现:一个包含3个示例和结构化输出约束的Prompt(约420 tokens)比零样本Prompt(约85 tokens)准确率提升12.3%,但成本增加4.9倍。通过动态示例筛选,最终在保持91.2%准确率的同时,

阿航Python 325 76 0 13天前
LoRA微调7B模型全记录:从QLoRA配置到loss收敛与推理效果对比

LoRA微调7B模型全记录:从QLoRA配置到loss收敛与推理效果对比

本文记录了一次完整的7B(7Billion)参数大模型微调实践,基于Qwen2.5-7B-Instruct,采用QLoRA(4-bit量化+LoRA)方案,在单卡A100-80G上完成训练。文章详细展示了从数据清洗、Prompt模板设计、训练超参(LoRA rank=64, alpha=128, lr=2e-4)到loss曲线(从2.3降至0.7)的全过程,并对比了微调前后模型在特定领域任务上的推

保持好奇服务器修炼册 265 63 0 13天前
asyncio重构Flask接口:QPS从320到1890的并发优化实录

asyncio重构Flask接口:QPS从320到1890的并发优化实录

某次线上监控发现,一个基于Flask的聚合查询API在高峰期P99延迟飙到2.8秒,单机QPS仅320。排查发现瓶颈不在数据库,而是阻塞式I/O调用——每次请求串行请求3个上游服务。我用asyncio+httpx重写核心调度层,并保留Flask作为Web框架(通过`asyncio.run`桥接),最终单机QPS提升至1890,P99延迟降到312ms。本文不聊理论,直接展示可运行的before/a

长期关注项目管理实践笔记 268 66 0 13天前
Docker Compose编排Nginx-Golang-PostgreSQL多服务容器化部署

Docker Compose编排Nginx-Golang-PostgreSQL多服务容器化部署

本文分享一个真实可运行的多服务docker-compose配置,涵盖Nginx 1.24反向代理、Golang 1.21 API服务、PostgreSQL 15数据库及Redis 7缓存,通过自定义网络隔离、命名卷持久化、healthcheck健康检查和depends_on条件控制启动顺序。配置实测在2C4G云主机上启动耗时43秒,内存占用稳定在512MB以内,适合中小型项目直接落地或二次改造。

清晨煮茶记 304 74 0 13天前
FastAPI与Flask性能对决:Profiling定位与多级缓存实战调优

FastAPI与Flask性能对决:Profiling定位与多级缓存实战调优

凌晨两点,线上API P95延迟飙升至2.3秒,数据库CPU打满100%。本文记录了一次完整的API性能调优过程:先用PySpy和cProfile定位瓶颈在N+1查询与JSON序列化,随后通过SQLAlchemy懒加载改造(查询次数从187次降至3次)和Redis多级缓存(命中率91%),最终P95延迟从2314ms降至287ms,吞吐量提升5.8倍。文章包含FastAPI与Flask的对比压测数

向内求解自动化成长记 250 53 0 13天前
Docker Compose编排多服务部署:网络、健康检查与启动顺序实践

Docker Compose编排多服务部署:网络、健康检查与启动顺序实践

生产环境容器化部署最头疼的就是服务启动顺序和依赖管理。本文基于Docker Compose 2.24 + Docker Engine 24.0,分享一个包含Nginx反向代理、Spring Boot应用、PostgreSQL和Redis的多服务编排方案。通过自定义网络隔离、healthcheck健康检查、depends_on条件控制,解决了服务启动竞态问题,将服务可用性从92%提升至99.5%,部

深巷做实验录 284 73 0 13天前
Prompt Engineering调优实录:实体抽取任务从52%到91%的Token效能跃升

Prompt Engineering调优实录:实体抽取任务从52%到91%的Token效能跃升

本文以电商评论实体抽取为靶场,对比零样本、Few-shot、CoT及Self-Consistency四种Prompt策略。实验基于GPT-4-turbo-preview(0125版),在200条真实评论上完成评测。通过结构化模板与动态示例注入,将F1值从0.52提升至0.91,单条Token成本从1.8K降至0.9K(降幅50%)。文中附完整代码与踩坑记录,揭示“示例质量>示例数量”的核心规律,并

持续研究品牌工作台 286 80 0 13天前
asyncio重构Flask接口,QPS从320到2100的完整记录

asyncio重构Flask接口,QPS从320到2100的完整记录

一个内部工单系统的列表接口,因为频繁查询外部监控API,平均耗时2.8秒,QPS只有320。我用asyncio把同步IO改成协程并发,配合semaphore限流,接口耗时降到420ms,QPS提升到2100。本文记录完整改造过程,包括asyncio与Flask的集成方式、信号量控制并发度、以及调试中遇到的Event Loop关闭异常。所有代码和压测数据均来自真实环境,Python 3.10.12,

阿南Dev手记 283 76 0 13天前
FastAPI接口200ms→12ms:profile定位与三层缓存优化实录

FastAPI接口200ms→12ms:profile定位与三层缓存优化实录

一个订单查询接口从215ms压测均值降至12.8ms,吞吐量从46 req/s提升至780 req/s。本文记录完整的优化链路:先用py-spy和cProfile定位到90%耗时在N+1查询与JSON序列化,再通过SQLAlchemy 2.0的selectinload合并查询,最后叠加Redis缓存与ORJSON响应模型。包含FastAPI 0.115与SQLAlchemy 2.0.36的具体配置

认真做创新拆解所 297 66 0 14天前
LangChain 0.3手写AI Agent:工具调用与记忆回环的12个坑

LangChain 0.3手写AI Agent:工具调用与记忆回环的12个坑

当 AutoGPT 的自主循环在真实业务中失控时,我决定用 LangChain 0.3.7 手写一个 200 行内的 Agent 内核。本文记录了一个支持 3 种自定义工具、滑动窗口记忆、异常熔断的 Agent 实现全过程。从工具描述 Token 膨胀导致的 47% 调用失败率,到记忆窗口 8 轮后准确率下降 23% 的实测数据,最终通过结构化工具定义和向量记忆压缩将单轮响应时间稳定在 1.8s。

认真做商业随身笔记 233 60 0 14天前
LangChain与AutoGPT启发下手写AI Agent循环控制与记忆管理实践

LangChain与AutoGPT启发下手写AI Agent循环控制与记忆管理实践

当AutoGPT的自动任务分解在真实业务中频繁因Token超限和工具调用死循环而崩溃时,我决定用LangChain的底层组件手写一个轻量Agent。本文记录了从零实现一个支持工具定义、短期记忆窗口、异常自动降级和循环次数硬限制的Agent全过程。实测在10轮对话内,相比直接调用OpenAI函数调用,工具选择准确率从72%提升至91%,Token消耗降低约38%。代码基于Python 3.10、La

大模型案例库 278 73 0 14天前
GitFlow与TrunkBased混合策略:支撑百人团队每日百次合并的版本控制方案

GitFlow与TrunkBased混合策略:支撑百人团队每日百次合并的版本控制方案

当团队从20人扩张到120人,原有单一主干分支策略导致发布前代码冻结长达3天,紧急修复频繁污染特性分支。我们结合GitFlow与TrunkBased设计了一套混合工作流,通过分支命名规范、自动化的Code Review门禁(基于GitLab 15.8+Merge Request Approvals)以及Jenkins Pipeline(2.4.3)的CI/CD集成,将发布周期从周缩短到天,线上缺陷

一只萤火虫收集工具日记 238 64 0 14天前
Git工作流重构记:分支策略与CI/CD流水线的一次落地实践

Git工作流重构记:分支策略与CI/CD流水线的一次落地实践

三个月前,我们的团队还在为“代码又冲突了”“谁把测试分支搞坏了”而焦头烂额。在将Git工作流从“自由发挥”重构为“GitFlow+PR强制+CI/CD门禁”后,线上故障率下降了约40%,功能分支平均存活时间从4.2天缩短至1.8天。本文不聊虚的,直接给出我们最终敲定的分支策略、基于GitLab的Code Review流程,以及串联Jenkins与SonarQube的流水线配置。文中所有yaml和s

推理加速研究笔记 338 75 0 14天前
React 19与Vue 3.5跨框架迁移:从Props钻取到Zustand/Pinia的工程化改造

React 19与Vue 3.5跨框架迁移:从Props钻取到Zustand/Pinia的工程化改造

本文记录了一个中后台项目从React 16 + Context向Zustand 4.5迁移,以及另一个Vue 3.2项目从Props钻取向Pinia 2.1迁移的完整过程。项目包含42个页面、187个组件,改造后首屏渲染时间从2.3s降至1.1s,组件重渲染次数减少63%。文中给出了具体的版本选型、迁移步骤、性能对比数据,以及我在迁移过程中遇到的5个典型坑位。

阿运维人手记 265 69 0 14天前
Git分支策略与CI/CD集成:携程机票团队3年工作流演进实录

Git分支策略与CI/CD集成:携程机票团队3年工作流演进实录

从2019年GitLab 12.5迁移到2022年GitLab 15.3,携程机票核心交易团队经历了从单主干到TrunkBased+环境分支的3次工作流重构。本文记录了我们在120人规模团队下,如何通过GitFlow变体解决发布零回滚、CodeReview效率提升40%、CI构建时间从22分钟压至6分30秒的真实踩坑过程。包含完整的`.gitlab-ci.yml`配置、分支保护规则脚本,以及我们如

小禾Coder手记 296 74 0 14天前
上一页 1 2 3 ... 7 8 9 ... 25 26 27 下一页

作者推荐