智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
FastAPI慢查询急救:Profiling定位到数据库N+1与Redis缓存策略

FastAPI慢查询急救:Profiling定位到数据库N+1与Redis缓存策略

一个订单查询接口,从平均850ms优化到47ms,吞吐量提升11倍。本文记录一次真实的FastAPI性能调优过程:先用cProfile和Py-Spy定位到90%耗时在SQLAlchemy的N+1查询,再通过`selectinload`解决关联查询,最后引入Redis缓存热点数据。文中包含完整的profiling命令、代码对比和压测数据(wrk工具),所有操作基于Python 3.11 + Fast

保持好奇增长成长记 475 121 0 19天前
Docker Compose编排SpringBoot+Redis+MySQL多服务部署实践

Docker Compose编排SpringBoot+Redis+MySQL多服务部署实践

本文分享一个生产级多服务项目的docker-compose.yml完整配置,涵盖自定义网络、命名卷挂载、healthcheck健康检查与depends_on条件启动。通过一个实际电商后台服务(Spring Boot 2.7 + MySQL 8.0 + Redis 7.0 + Nginx 1.24)的部署案例,展示如何解决容器启动顺序混乱、数据库初始化失败、日志持久化丢失等常见问题。配置经过压测验证

松鼠追着需求跑 460 118 0 19天前
LangChain与AutoGPT双引擎:手写AI Agent的记忆与循环控制机制

LangChain与AutoGPT双引擎:手写AI Agent的记忆与循环控制机制

在复杂任务场景下,单轮LLM调用成功率不足40%,而引入记忆与循环控制后,我的Agent在网页数据抓取任务中成功率提升至92%。本文基于LangChain 0.1.0与AutoGPT架构思想,手写一个轻量级Agent,覆盖工具定义、记忆管理、错误处理与循环控制四个核心模块。通过200行代码,实现多步骤任务自动拆解与执行,附完整代码与性能对比数据。

路过的码农日常 438 116 0 19天前
RAG召回率从64%到91%:Embedding与Rerank联合调优实录

RAG召回率从64%到91%:Embedding与Rerank联合调优实录

线上问答系统上线三个月,用户反馈“答非所问”占比高达22%。定位问题出在召回阶段:chunk过大导致语义稀释,BGE-large-zh-v1.5在垂直医疗术语上表现拉胯。本文记录一次完整的RAG系统优化过程,涉及chunk粒度从512降到256、Embedding模型切换为text2vec-large-chinese、引入bge-reranker-base重排。优化后,命中率(Recall@5)从

复盘增长记 490 110 0 19天前
告别Props钻透:React 18与Vue 3项目迁移Zustand与Pinia的完整记录

告别Props钻透:React 18与Vue 3项目迁移Zustand与Pinia的完整记录

在维护一个组件层级超过6层的中型后台项目时,频繁的Props透传和Context重渲染让页面交互出现明显卡顿(LCP从1.8s恶化到2.4s)。本文记录了将React 18项目从Context+useReducer迁移至Zustand v4,以及Vue 3项目从Provide/Inject迁移至Pinia v2的决策过程与实施细节。对比了三种方案的内存占用与渲染性能,并给出了具体的代码迁移步骤与性

路过的数据库玩家手记 498 118 0 19天前
Docker Compose编排多服务项目:网络、健康检查与启动顺序全解析

Docker Compose编排多服务项目:网络、健康检查与启动顺序全解析

本文分享一个基于Docker Compose v2.20.2编排的电商后端多服务项目,涵盖Nginx、Spring Boot应用、PostgreSQL、Redis和RabbitMQ共5个容器。通过自定义bridge网络隔离流量、volume持久化数据、healthcheck实现依赖服务就绪检测,以及depends_on条件控制启动顺序。实测部署时间从手工docker run的8分钟缩短至90秒,服

猞猁偶尔重构 579 133 0 19天前
RAG召回率从61%到89%:chunk重切、Embedding换代与Rerank落地的完整记录

RAG召回率从61%到89%:chunk重切、Embedding换代与Rerank落地的完整记录

三个月的RAG系统调优,踩遍了chunk尺寸、Embedding模型和召回排序的坑。最终通过将固定512字符切块改为按Markdown标题动态切片、Embedding从`text2vec-large-chinese`切换至`bge-large-zh-v1.5`、并引入`bge-reranker-v2-m3`做重排,让知识库问答的Recall@5从61.3%提升至89.7%,幻觉率下降约42%。这篇

一线低代码实验室 553 131 0 19天前
Git工作流重构记:从混乱主干到GitFlow+CI/CD的团队蜕变

Git工作流重构记:从混乱主干到GitFlow+CI/CD的团队蜕变

三个月前,我们团队还在为“直接push主干”付出代价:平均每周3次构建失败,代码评审形同虚设,紧急修复经常引入新Bug。本文记录了我们基于Git 2.30.2 + GitLab 14.3 + Jenkins 2.303.1构建的完整Git工作流体系。通过实施严格的分支策略、强制Code Review(至少1人批准,关键模块2人)、以及自动化CI/CD流水线(构建+单元测试+部署,全流程平均18分钟

缓存拒绝内耗工程日常 586 136 0 19天前
Prompt Engineering实测:四套模板让GPT-4o信息抽取准确率从61%升至93%

Prompt Engineering实测:四套模板让GPT-4o信息抽取准确率从61%升至93%

本文以“从技术合同中抽取验收标准与违约责任条款”为具体任务,对比了零样本、角色设定、思维链(CoT)与结构化输出(JSON Schema)四套Prompt模板在GPT-4o(1106-preview)上的表现。实验消耗约1.2M token,总费用$8.64。结果显示:结构化输出模板将字段准确率从61%提升至93%,单次推理token消耗降低47%。文中附完整代码与踩坑记录,含temperatur

认真成长云原生成长记 414 110 0 19天前
GitFlow与Trunk-Based分支策略取舍及CI/CD自动化配置

GitFlow与Trunk-Based分支策略取舍及CI/CD自动化配置

本文基于真实团队(12人后端+5人前端)从GitFlow迁移至Trunk-Based+Release Branch混合模式的实践记录。通过引入Git 2.39.0的`git switch`、`git worktree`及自定义pre-push钩子,将代码Review平均等待时间从4.2小时降至35分钟,CI构建成功率从87%提升至96.5%。文中给出了完整的`gitflow-avh`配置、GitL

分支持续优化工程日常 572 136 0 20天前
7B模型LoRA/QLoRA微调全记录:显存占用降80%与推理质量对比

7B模型LoRA/QLoRA微调全记录:显存占用降80%与推理质量对比

本文记录了一次完整的7B(ChatGLM2-6B)指令微调实践,对比了全参微调、LoRA与QLoRA三条路线。在单张24GB显存的RTX 3090上,QLoRA(4-bit NormalFloat + 双LoRA适配器)成功将训练显存峰值从全参微调的54GB压至11.2GB,训练速度仅下降约35%。通过自建的5000条领域问答数据集微调后,模型在领域测试集上的ROUGE-L从0.21提升至0.38

会写字的数据人 613 147 0 20天前
Prompt模板迭代实录:从37%到82%的抽取准确率提升

Prompt模板迭代实录:从37%到82%的抽取准确率提升

在构建金融公告信息抽取系统时,我针对Prompt Engineering进行了12轮迭代实验,对比了零样本、少样本、思维链及模板约束等策略。通过引入结构化输出模板与错误样本反例,最终将事件类型识别准确率从37%提升至82%,单次调用Token消耗从1876降至1042。本文记录了完整的实验数据、踩坑日志与代码实现,展示Prompt调优对下游任务的决定性影响。

持续研究创新案例库 561 133 0 20天前
React 19与Vue 3.5下从Props钻取到Zustand/Pinia的状态重构实录

React 19与Vue 3.5下从Props钻取到Zustand/Pinia的状态重构实录

在维护一个拥有120+组件的后台管理系统时,我遭遇了Props钻取地狱——一个筛选条件需要穿过7层组件才能到达表格组件,导致每次状态变更触发4次无效渲染。本文记录了我将项目从原生Context/Props迁移到Zustand 5.x(React)与Pinia 3.x(Vue)的完整过程:包括方案选型对比(含Redux Toolkit与MobX的弃用理由)、分阶段迁移策略(按数据域拆分Store)、

阿哲ProductLab 496 105 0 20天前
Git分支模型与Code Review流水线:支撑200人团队的协作架构

Git分支模型与Code Review流水线:支撑200人团队的协作架构

当团队从15人扩张到200人,原先的GitHub Flow分支策略开始频繁产生冲突合并、review阻塞和误发布。本文记录了我们迁移到GitFlow+Trunk Based混合模型的全过程,包括分支保护规则、基于GitHub Actions的CI流水线(构建耗时从11分钟降至4分30秒)、以及强制Code Review的机器人检查项。文中提供了完整的`.github/workflows/ci.ym

小北Rust手记 585 145 0 20天前
FastAPI与Flask接口性能调优:Profiling定位与缓存策略实测

FastAPI与Flask接口性能调优:Profiling定位与缓存策略实测

一个订单查询接口从850ms压到47ms,吞吐量提升12倍。本文记录了一次完整的API性能调优过程:先用cProfile和py-spy定位CPU与IO瓶颈,再通过SQLAlchemy懒加载优化和Redis缓存策略,分别针对FastAPI和Flask框架进行对比测试。文章包含完整的profiling命令、代码改造方案以及wrk压测数据,特别指出了Python异步框架在高并发下的GIL陷阱。如果你正在

海獭喜欢开源 598 158 0 20天前
Milvus与Qdrant实测对比:亿级向量下的RAG检索延迟与资源消耗

Milvus与Qdrant实测对比:亿级向量下的RAG检索延迟与资源消耗

在构建一个千万级商品向量检索的RAG系统时,我同时压测了Milvus 2.4.1和Qdrant 1.9.7。结果显示:在16核32G裸机部署下,Qdrant的P99查询延迟为23ms,比Milvus快31%;但Milvus在批量写入吞吐上领先52%(12.8k QPS vs 8.4k QPS)。内存占用方面,Qdrant在HNSW索引下峰值仅为Milvus的60%。本文将从部署、调参、压测脚本三个

队列正在加载求生记 674 156 0 20天前
向量数据库选型实录:Milvus与Qdrant在亿级商品检索下的性能对决

向量数据库选型实录:Milvus与Qdrant在亿级商品检索下的性能对决

本文基于实际业务场景(电商以图搜图,5000万条128维向量,QPS峰值1200),完整记录了Milvus 2.3.3与Qdrant 1.9.0的选型对比过程。从Docker部署、Python客户端写入、到查询性能与资源占用,全程实测数据说话:Milvus在百万级数据下召回准确率稳定在99.2%,但Qdrant在500万数据时延迟已飙升至487ms,而Milvus仅需92ms。最终我们选择了Mil

小工程师日常 601 152 0 20天前
Git分支策略与流水线联动:日均200次提交的协作方案

Git分支策略与流水线联动:日均200次提交的协作方案

当团队从12人扩张到40人,主干分支从每周3次冲突演变为每天15次构建阻塞,我们被迫重构Git工作流。本文基于Git 2.39.1、GitLab 15.11与Jenkins 2.414.2,落地了trunk-based分支模型+MR强制Code Review+流水线门禁的三层体系。通过预提交钩子、合并队列和自动化回滚,将平均合并等待时间从47分钟降至6分钟,线上事故回滚耗时控制在90秒内。文中给出

生产级机器学习拆解局 512 132 0 20天前
Docker Compose编排实录:用healthcheck与depends_on终结服务启动竞态

Docker Compose编排实录:用healthcheck与depends_on终结服务启动竞态

生产环境迁移Spring Boot + Redis + MySQL + Nginx四服务时,因启动顺序失控导致连崩3次,每次恢复耗时20分钟。本文记录如何用Docker Compose 2.24.2的depends_on条件表达式、自定义healthcheck和双网络桥接,将服务就绪时间从4分15秒压缩到58秒,并解决容器重启后IP漂移导致的连接池雪崩问题。含完整可复制配置和压测数据对比。

实战派大模型工具箱 555 155 0 20天前
Docker Compose多服务编排:网络隔离与健康检查实战配置

Docker Compose多服务编排:网络隔离与健康检查实战配置

本文通过一个真实的后端项目,分享基于Docker Compose v2.24编排Nginx、Spring Boot、PostgreSQL、Redis四个服务的完整配置。文中给出了带静态IP的子网划分方案、基于healthcheck的启动依赖控制、以及通过卷挂载实现日志持久化的具体参数。配置上线后,服务启动时间从手工部署的8分钟缩短至45秒,容器重启次数下降90%。适合正在从单机部署转向容器化编排的

体验实验场 654 153 0 20天前
上一页 1 2 3 ... 13 14 15 ... 25 26 27 下一页

作者推荐