智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
从Milvus到Qdrant:向量数据库选型实测与性能对比

从Milvus到Qdrant:向量数据库选型实测与性能对比

本文以电商图片搜索业务为场景,记录了Milvus 2.3.2与Qdrant 1.7.2在相同硬件环境下的部署、查询性能与资源占用对比。通过10万条256维向量数据集实测,Qdrant在单机模式下P99召回率95%时查询延迟仅为Milvus的1/3,内存占用低40%。文章包含Docker部署步骤、Python客户端代码及踩坑记录,帮助你根据业务场景做出合理选型。

稳步前行商业成长记 2551 220 0 2026-07-19
Git工作流实践:从分支策略到CI/CD集成的团队协作方案

Git工作流实践:从分支策略到CI/CD集成的团队协作方案

当20人团队日均提交50+次代码、每月上线3个版本时,Git工作流的混乱会导致合并不了、线上事故频发。本文基于真实项目经验,分享一套经过验证的Git工作流:包含基于Git Flow优化的分支策略、基于Gerrit的Code Review流程、与Jenkins Pipeline深度集成的CI/CD方案。文章提供完整的`.gitignore`配置、`Jenkinsfile`模板以及分支命名规范,并展示

模型别催的开发者 2603 238 0 2026-07-19
LoRA微调7B模型全流程:数据准备、训练配置与效果实测

LoRA微调7B模型全流程:数据准备、训练配置与效果实测

本文记录一次完整的LLM微调实践,基于Llama-2-7B模型,使用LoRA/QLoRA技术在单张RTX 4090上完成指令微调。数据层面采用Alpaca格式的2000条中文问答对,训练配置中LoRA rank=8、alpha=16、target_modules=[q_proj,v_proj],使用BitsAndBytes 4bit量化。训练耗时约3小时,loss从2.3降至0.85,推理效果显示

业余后端手记 2488 224 0 2026-07-19
Git分支策略与CI/CD流水线:团队协作的版本控制实践

Git分支策略与CI/CD流水线:团队协作的版本控制实践

团队从10人扩展到50人后,我们的Git工作流从“所有人推master”演变为一套基于Git Flow + Feature Branch的标准化方案。本文记录了一个季度内代码冲突减少78%、PR合并周期从3天缩至4小时的改进历程。你会看到我们如何在Git 2.35.1环境下设计分支策略、配置ESLint + Prettier的Code Review钩子、在Jenkins + GitLab CI上实

业余后端手记 2633 214 0 2026-07-19
7B模型LoRA微调全流程:数据、训练、Loss与推理对比

7B模型LoRA微调全流程:数据、训练、Loss与推理对比

手里有一张24G显存的RTX 4090,想微调一个7B模型做领域问答?本文记录了一次完整的LoRA/QLoRA微调实践,从数据清洗、训练配置到Loss收敛曲线、推理效果对比,全程可复现。使用`peft` 0.7.1 + `transformers` 4.35.0,QLoRA 4-bit量化后显存占用仅14GB,训练3个epoch后BLEU得分从0.12提升至0.45,推理输出长度和语义连贯性显著改

持续研究需求分析灵感仓库 2598 241 0 2026-07-19
FastAPI异步重构与Redis缓存:API响应从2.3秒降至95ms

FastAPI异步重构与Redis缓存:API响应从2.3秒降至95ms

线上一个用户画像查询接口,数据量仅5万条,单次响应却要2.3秒。通过Py-Spy火焰图定位到SQLAlchemy ORM懒加载和N+1查询是元凶。改用FastAPI异步+SQLAlchemy 2.0 selectinload + Redis缓存,QPS从12提升到780,P99延迟从3.1秒降到210ms。本文记录完整的profiling、优化、压测过程,附可复现代码与配置参数。

纸上敲键盘 2447 222 0 2026-07-19
从Props地狱到Pinia/Zustand:前端状态管理迁移实录

从Props地狱到Pinia/Zustand:前端状态管理迁移实录

一个中大型后台项目,初期使用React Context+Props传递状态,当组件树超过5层、状态变量突破30个时,出现了严重的“Props drilling”和无效渲染。首屏加载后,状态更新导致页面卡顿300ms。本文记录了从Context/Zustand(React)和Vuex/Pinia(Vue)两个技术栈的实际迁移过程,包含方案对比、代码改造步骤、性能数据对比,以及迁移中遇到的“幽灵状态”

阿南_Dev 2414 201 0 2026-07-19
用asyncio重构Web API:并发从10提升到300的完整改造

用asyncio重构Web API:并发从10提升到300的完整改造

一个基于Flask的订单查询API,在双11压测中因IO阻塞导致平均响应时间从80ms飙升到3.2s。通过引入asyncio + aiohttp进行异步化改造,同步数据库查询改为异步连接池,同时利用asyncio.Semaphore控制并发度。改造后,在相同硬件配置(4核8G)下,QPS从150提升到2800,P99延迟从2.1s降至120ms。本文记录完整的改造过程、代码示例、性能对比数据以及三

一只章鱼偶尔重构 2554 222 0 2026-07-19
LoRA微调7B模型实践:数据、训练、效果全流程拆解

LoRA微调7B模型实践:数据、训练、效果全流程拆解

微调大模型是当前企业落地LLM的核心手段,但全参微调7B模型需要至少56GB显存,成本极高。本文基于LoRA和QLoRA方法,在单卡A100 80G上完成对Qwen2.5-7B-Instruct的领域微调。数据来自真实的客服对话日志(约2万条),训练时仅更新0.1%的参数,显存占用仅18GB。我们将详细展示数据清洗格式、BitsAndBytes量化配置、训练超参调优过程,并对比微调前后模型在意图识

周末开源实验室 2555 207 0 2026-07-19
Git工作流改造:分支策略+CI/CD集成提升30%交付效率

Git工作流改造:分支策略+CI/CD集成提升30%交付效率

团队从2019年沿用至今的Git-Flow分支策略,在微服务架构下暴露出合并冲突频繁、发布周期长等痛点。本文记录了一次完整的Git工作流改造实践:重新设计基于Trunk的分支模型,引入GitHub Actions自动化Code Review流水线,集成SonarQube静态检查与自动部署。改造后,功能分支平均存活时间从3.2天降至1.1天,代码评审通过率从62%提升至89%,线上事故回滚率下降40

认真做设计工具箱 2524 231 0 2026-07-19
基于Git Flow和Trunk的混合分支策略及CI/CD落地

基于Git Flow和Trunk的混合分支策略及CI/CD落地

在50人规模的后端团队中,我们曾因分支混乱导致每月平均3次线上事故。本文记录了将Git Flow与Trunk-based Development混合使用的实践:通过`feature/`分支做隔离开发,`release/`分支做冻结测试,配合GitHub Actions的自动化流水线,将代码从提交到生产部署的周期从2天缩短到4小时。文中包含分支命名规范、Code Review Checklist、以

海边敲键盘记 2537 216 0 2026-07-19
上一页 1 2 3 ... ... 25 26 27

作者推荐