智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
Git分支策略与Code Review流水线:从混乱到有序的版本控制实践

Git分支策略与Code Review流水线:从混乱到有序的版本控制实践

在15人研发团队中,我们曾因分支混乱导致每周平均3次合并冲突、2次误推master事故。通过引入Git Flow + GitHub PR模板 + Jenkins多分支流水线,将发布周期从2天缩短至4小时,冲突率下降80%。本文分享这套工作流的完整设计、配置代码与踩坑记录,包含`.gitignore`策略、`git bisect`定位回归、以及Jenkinsfile声明式流水线的具体参数,适合中型团

云端企鹅会做产品 301 75 0 19天前
Prompt工程化调优实录:从42%到89%的指令压缩与Token成本实验

Prompt工程化调优实录:从42%到89%的指令压缩与Token成本实验

同一文本分类任务,我用了7种Prompt模板迭代,准确率从42%飙到89%,Token消耗却从单次1872降到642。本文记录了在llama.cpp + Qwen2.5-7B-Instruct环境下,不同指令结构、角色设定、Few-shot示例对输出的影响。包含完整代码、温度参数调节、以及一次因Prompt过长触发上下文截断导致雪崩的翻车现场。全文3000字,全是实测数据。

刺猬爱写代码日记 446 99 0 19天前
Git分支策略与Code Review流水线:团队协作从混乱到有序的蜕变

Git分支策略与Code Review流水线:团队协作从混乱到有序的蜕变

当团队从5人扩张到25人时,master分支上的merge冲突和误推送让发布延迟了40%。本文记录了我们如何通过Git Flow改良版+GitLab Code Review+Jenkins CI/CD的组合拳,将分支管理规范化。你会看到具体的分支保护规则、.gitlab-ci.yml配置、以及我们如何用pre-commit钩子把代码风格问题拦截在提交前。最终,我们的发布周期从2天缩短到4小时,线上

老程_Lab手记 428 95 0 19天前
React 19与Vue 3.5状态管理迁移实录:从Props钻透到Pinia/Zustand的架构蜕变

React 19与Vue 3.5状态管理迁移实录:从Props钻透到Pinia/Zustand的架构蜕变

在维护一个迭代两年的后台管理系统时,我面对的是超过30层嵌套的Props传递和Context导致的频繁重渲染。本文记录了将项目从Context/Props模式迁移至Zustand v5与Pinia v3的完整过程。通过对比两种方案在React 19与Vue 3.5下的性能表现,迁移后组件渲染耗时平均降低42%,代码量减少35%,且解决了因Context value变化引发的全子树更新问题。文中包含

持续研究数字化随身笔记 364 84 0 19天前
7B模型LoRA/QLoRA微调全记录:从数据准备到loss曲线与推理对比

7B模型LoRA/QLoRA微调全记录:从数据准备到loss曲线与推理对比

上周刚用LoRA和QLoRA把Llama-3-8B(实际权重7B)微调成法律问答模型,踩了一堆坑,也拿到了实打实的数据。在单张A100(80G)上,QLoRA的显存峰值只有14.3G,训练速度是LoRA的1.7倍,最终loss从1.82降到0.47。推理阶段,微调后的模型在20个法律案例问答上,答案相关性和格式规范度远超base模型,但偶尔会出现幻觉。本文记录完整流程,包括数据清洗、bitsand

实战派自动化开发日志 407 89 0 19天前
FastAPI慢查询优化实录:从1500ms到80ms的profiling与缓存改造

FastAPI慢查询优化实录:从1500ms到80ms的profiling与缓存改造

一次真实的API性能调优过程。一个基于FastAPI的订单查询接口,单次请求耗时1500ms,QPS仅120。通过cProfile定位到90%时间消耗在N+1数据库查询和重复计算上。使用SQLAlchemy 2.0的selectinload替代lazy load,配合Redis缓存热点数据和Cython加速序列化,最终将P95延迟降到80ms,QPS提升至1800。本文记录完整的profiling

野生Java玩家手记 389 101 0 19天前
7B模型LoRA/QLoRA微调全记录:从数据清洗到显存占用对比

7B模型LoRA/QLoRA微调全记录:从数据清洗到显存占用对比

本文记录了我使用LoRA和QLoRA技术微调Qwen2-7B-Instruct模型的全过程。通过实际对比,QLoRA在单张24GB显存的RTX 3090上成功完成微调,峰值显存占用仅18.7GB,而标准LoRA则需要至少32GB显存。微调后的模型在领域问答任务上的BLEU分数从基线0.23提升至0.41,人工评测满意度从61%提升至87%。文章详细展示了数据准备、训练配置、loss曲线分析及推理效

数据库别催的程序员 363 95 0 19天前
Docker Compose编排多服务:网络卷健康检查与依赖启动调优

Docker Compose编排多服务:网络卷健康检查与依赖启动调优

本文基于Docker Compose v2.24 + Docker Engine 26.1,分享一个真实的生产级多服务编排方案:Nginx反向代理 + Spring Boot 3应用 + PostgreSQL 15 + Redis 7。重点解决三个痛点:静态IP下的服务间通信、容器重启后数据卷权限丢失、以及Spring Boot在数据库未就绪时的启动崩溃。通过healthcheck + depen

认真做交互拆解所 408 104 0 19天前
React 19与Vue 3.5状态管理迁移:从Context/Props到Zustand与Pinia的工程化实践

React 19与Vue 3.5状态管理迁移:从Context/Props到Zustand与Pinia的工程化实践

在维护一个拥有80+页面、日均PV超50万的B端中后台系统时,我遇到了Context导致的全树重渲染和Props层层透传的维护噩梦。本文记录了将React 18.3项目从Context迁移至Zustand 4.5,以及将Vue 3.4项目从Props+emit迁移至Pinia 2.2的全过程。通过Chrome Performance面板实测,迁移后首屏交互响应时间从210ms降至65ms,组件重渲

长期主义数据库学习者 351 89 0 20天前
asyncio重构Flask接口:并发等待缩短3.2倍响应时间

asyncio重构Flask接口:并发等待缩短3.2倍响应时间

一个内部工单系统的列表接口,在日均调用量2万次时P95延迟飙到1.8秒,数据库连接池被打满。我用asyncio配合httpx和asyncpg,把三个串行的HTTP调用和两次SQL查询改造成并发协程,顺手解决了事件循环中同步阻塞的坑。改造后P95降至560ms,依赖服务超时不再拖垮主流程。这篇文章记录完整的重构过程、对比代码和压测数据,包括asyncio.Semaphore限流、awaitable与

北岸读书集 390 92 0 20天前
LangChain+AutoGPT架构手写Agent:循环控制与记忆管理的7个关键坑

LangChain+AutoGPT架构手写Agent:循环控制与记忆管理的7个关键坑

上周在电商智能客服场景中,我用LangChain 0.1.0重写了一个基于AutoGPT思路的Agent,处理2000条真实用户咨询时,任务完成率从纯Prompt工程的63%提升到89%。但这中间踩了记忆膨胀、工具死循环、错误恢复策略失效三个大坑。本文不聊虚的,直接给你看一个能跑的最小Agent代码,包含工具注册、Token级记忆裁剪、最大迭代保护、异常隔离四个模块,并附上压测数据(QPS=12.

企业级多模态探索频道 383 96 0 20天前
Python异步编程:用asyncio把API响应时间从3.2秒压到0.4秒

Python异步编程:用asyncio把API响应时间从3.2秒压到0.4秒

一个后台管理系统的列表接口,因为串行调用外部服务,响应时间飙到3.2秒。我用asyncio重构后,降到0.4秒,QPS从50提升到400。这篇文章记录完整过程:从同步代码的问题分析,到async/await改造,再到信号量限流、超时控制、连接池复用这些坑。版本是Python 3.10.9 + FastAPI 0.95.2 + httpx 0.24.1。如果你也遇到IO密集型的性能瓶颈,这篇文章应该

移动开发笔记 370 88 0 20天前
LangChain与AutoGPT思想碰撞:手写轻量AI Agent的五个核心机制

LangChain与AutoGPT思想碰撞:手写轻量AI Agent的五个核心机制

当AutoGPT的自主循环遇上LangChain的工具调用,我们能否用300行代码实现一个可用的Agent?本文记录了一次真实开发经历:基于LangChain 0.1.0与GPT-4-turbo,手写了一个支持工具注册、短期记忆、异常自愈与步数限制的Agent内核。在“查询数据库并发送邮件”的测试场景中,该Agent在6轮对话内完成任务,工具调用成功率97%,对比直接调用LLM的基线方案,错误率下

小唐JavaLab 422 100 0 20天前
Milvus与Qdrant选型实测:千万级向量下的部署、性能与资源博弈

Milvus与Qdrant选型实测:千万级向量下的部署、性能与资源博弈

在千万级128维向量、QPS约200的实时检索业务中,我对Milvus 2.4.1与Qdrant 1.9.0进行了全流程对比。从Docker部署到性能压测,Qdrant在单机8C16G下P99延迟稳定在12ms,而Milvus在同等资源下P99达到35ms,但Milvus在批量写入(5000条/批)时吞吐量高出Qdrant约40%。本文记录了两者的配置参数、资源占用曲线及一个诡异的“内存不释放”坑

老AI工程师日常 404 102 0 20天前
LangChain与AutoGPT思想融合:手写轻量级Agent的六个关键实现

LangChain与AutoGPT思想融合:手写轻量级Agent的六个关键实现

当AutoGPT的自主循环遇到LangChain的工具抽象,我花了3天在Python 3.11环境下用两者思想手写了一个120行核心代码的Agent。它能在MMLU子集上完成87%的工具调用准确率,单次任务平均耗时2.3秒。本文将拆解工具定义schema、基于消息窗口的记忆压缩、三次重试熔断机制以及while循环的退出条件设计——这些细节决定Agent是“玩具”还是“工具”。不堆砌概念,直接上可运

半路开源爱好者日常 390 103 0 20天前
asyncio重构Flask接口:请求耗时从2.1秒降至0.4秒

asyncio重构Flask接口:请求耗时从2.1秒降至0.4秒

我负责的报表服务中,一个聚合三个外部API的接口在压测时P99延迟飙到2.1秒,TPS只有80。在Python 3.10.12环境下,我用asyncio + aiohttp替换了原本基于requests的串行调用,配合信号量限流和超时重试机制,将P99降到0.4秒,TPS提升到320。本文记录了完整的重构过程,包括协程设计、事件循环监控、以及一个差点让我放弃的SSL坑。

深夜创业研究所 466 114 0 20天前
Milvus与Qdrant选型实录:千万级向量检索与资源消耗对比

Milvus与Qdrant选型实录:千万级向量检索与资源消耗对比

在智能问答系统的语义召回模块中,我们需要从1200万条768维向量中实现毫秒级Top-K检索。本文记录了Milvus 2.4.x与Qdrant 1.9.x在同一批数据、同一台物理机(32C/64G/SSD)下的完整对比:包括Docker部署细节、HNSW索引调参过程、真实QPS曲线以及内存/磁盘占用。实测发现:Milvus在批量写入(5k/s vs 1.2k/s)和吞吐量(单机QPS 1800 v

小苏_DesignLab 388 100 0 20天前
Prompt Engineering调优实录:实体抽取任务下5轮迭代的token消耗与精度对比

Prompt Engineering调优实录:实体抽取任务下5轮迭代的token消耗与精度对比

在实体抽取任务中,我针对同一份法律文书数据,设计了5种不同结构的Prompt(零样本、少样本、CoT、Self-Consistency、角色约束),在GPT-4-turbo(1106版本)下分别测试。实验结果显示:角色约束+少样本的组合F1值最高(0.87),但token消耗是零样本的3.2倍;而CoT在复杂嵌套实体上召回率提升11%,但输出延迟增加1.8秒。本文记录了完整的迭代过程、踩坑点和成本

一线职场案例库 467 121 0 20天前
7B模型LoRA微调显存压至16G:Qwen2.5指令遵循提升42%

7B模型LoRA微调显存压至16G:Qwen2.5指令遵循提升42%

用一张RTX 4090对Qwen2.5-7B-Instruct做LoRA微调,处理一个客服意图识别+槽位填充的混合任务。经过96小时训练(batch size 128,学习率2e-4),在500条测试集上意图准确率从78.3%提升到91.2%,槽位F1从0.71提升到0.88。同时尝试了QLoRA(4bit NF4量化),训练显存从24G降到14.5G,推理速度仅下降12%。本文记录完整的数据准备

生产级数据科学开发日志 374 93 0 20天前
asyncio重构Flask API:请求耗时从380ms降至47ms

asyncio重构Flask API:请求耗时从380ms降至47ms

某个周末,我负责的订单查询接口在压测时P99延迟飙到1.2秒,数据库连接池被占满,CPU却只有30%利用率。排查后发现罪魁祸首是串行调用三个上游HTTP服务——每个耗时120ms,加起来360ms,加上业务逻辑正好380ms。我用asyncio+httpx重写了这个接口,配合信号量控制并发,P99降到47ms,QPS从80提升到620。本文记录完整的重构过程、代码对比、踩坑经历(包括协程泄漏和Ev

小林_Cloud手记 380 104 0 20天前
上一页 1 2 3 ... 11 12 13 ... 26 27 28 下一页

作者推荐