智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
Prompt Engineering调优实录:从8.2%到91.4%准确率的CRF任务迭代

Prompt Engineering调优实录:从8.2%到91.4%准确率的CRF任务迭代

在处理一个中文命名实体识别(NER)任务时,我通过系统性地迭代Prompt模板,将GPT-4-turbo的F1值从初始的8.2%提升至91.4%。全程共消耗约12.6万tokens,对比了零样本、少样本、结构化输出约束、思维链等5种Prompt策略。实测发现:直接提供JSON Schema约束输出格式可使解析错误率降低76%,而加入两个正例和两个反例的少样本策略效果最佳。本文记录了完整的实验数据、

一线数据分析笔记 993 242 0 2026-08-01
Milvus与Qdrant选型实测:千万级向量检索资源消耗与延迟对比

Milvus与Qdrant选型实测:千万级向量检索资源消耗与延迟对比

在电商以图搜图业务中,我们对比了Milvus 2.4.1与Qdrant 1.9.2在相同数据集(1000万条768维向量)下的部署复杂度、查询延迟与内存占用。实测结果显示:Qdrant在单机SSD模式下P99延迟低至23ms,内存占用仅3.2GB;Milvus在分布式集群下吞吐更高,但单机部署时索引构建耗时是Qdrant的2.3倍。本文记录了完整的部署步骤、性能压测数据与踩坑经验,供选型参考。

复盘增长记 1113 247 0 2026-08-01
React 19与Vue 3.5下的状态管理迁移:从Context到Zustand/Pinia的工程实践

React 19与Vue 3.5下的状态管理迁移:从Context到Zustand/Pinia的工程实践

当项目超过50个组件、状态更新导致首屏渲染耗时从210ms飙升至780ms时,Context/Props已显疲态。本文记录一次真实的中台系统重构:对比React 19的Context + useReducer与Zustand 5.x、Vue 3.5的provide/inject与Pinia 3.x在性能、代码量、可维护性上的差异。通过具体代码演示迁移步骤,并附上LCP从2.8s降至1.2s、组件重

缓存先跑起来的程序员 920 235 0 2026-08-01
Prompt Engineering实测:5轮迭代让GPT-4o输出准确率从67%升至92%

Prompt Engineering实测:5轮迭代让GPT-4o输出准确率从67%升至92%

本文基于实际业务场景(电商评论情感分类),记录了对GPT-4o(gpt-4o-2024-05-13)进行Prompt工程优化的完整过程。通过对比零样本、少样本、CoT(思维链)、结构化输出及自一致性(Self-Consistency)5种策略,我发现单纯增加示例token消耗增加87%但准确率仅提升4%,而结合角色设定+XML约束+CoT的组合方案,在准确率92%的同时将无效输出比例从15%降至0

一只Rust玩家 1113 243 0 2026-08-01
Git分支策略与Code Review流水线:支撑200人团队的协作体系

Git分支策略与Code Review流水线:支撑200人团队的协作体系

当团队从20人扩张到200人,原先“一条master走天下”的工作流彻底崩坏——合并冲突日均17次,线上事故3起,代码审查形同虚设。本文基于Git 2.39.1与GitLab 15.11,拆解一套经过生产环境验证的分支策略:trunk-based与GitFlow的折中方案,配合基于Merge Request的强制Code Review流水线,以及Jenkins 2.414.2驱动的CI/CD集成。

边学边做人工智能学习者 1075 243 0 2026-08-01
Docker Compose编排多服务:网络隔离、健康检查与启动顺序实战

Docker Compose编排多服务:网络隔离、健康检查与启动顺序实战

本文分享一个真实项目中的docker-compose.yml配置,包含Nginx、Spring Boot、PostgreSQL、Redis四个服务。通过自定义网络实现服务隔离,使用volume持久化数据库和日志,利用healthcheck和depends_on条件控制启动顺序。解决了一个困扰我两天的服务启动竞态问题,最终将服务启动时间从原来的90秒压缩到35秒,并保证了100%的启动成功率。

长期关注增长思考录 1182 270 0 2026-08-01
Git分支策略与CI/CD集成:从混乱到有序的协作重构

Git分支策略与CI/CD集成:从混乱到有序的协作重构

接手一个40人团队,Git仓库日均30+次提交,却因混乱的分支命名和缺乏Code Review导致每周至少2次代码冲突回滚。本文记录我引入Git Flow + GitHub Flow混合模型,配合Jenkins Pipeline实现自动化构建、测试和部署的完整过程。通过规范分支策略、强制执行PR Review、集成SonarQube静态检查,将代码冲突率从15%降至2%,部署失败率降低70%,发布

小顾_Cloud 1058 247 0 2026-08-01
7B模型LoRA微调实录:显存8G也能跑,效果直追全量微调

7B模型LoRA微调实录:显存8G也能跑,效果直追全量微调

上周接到一个任务,要把一个7B模型在垂直领域(法律问答)上做微调。手头只有一张RTX 4090,24G显存,但全量微调7B模型至少需要80G以上显存。试了LoRA和QLoRA两种方案,最终用QLoRA在18G显存下跑完3个epoch,法律问答准确率从基线54.7%提升到82.3%,训练时间比全量微调缩短了70%。本文记录了从数据准备、训练配置到推理效果对比的完整过程,包括踩过的坑和最终的调优方案。

飞鸟偶尔重构 1009 228 0 2026-08-01
Docker Compose编排多服务:网络、卷、健康检查与启动顺序全解析

Docker Compose编排多服务:网络、卷、健康检查与启动顺序全解析

本文分享一个真实项目中的docker-compose配置,包含Nginx、后端API、PostgreSQL、Redis四个服务。通过自定义网络隔离流量、命名卷持久化数据、健康检查控制依赖启动顺序。实测部署后容器启动时间从48秒缩短至22秒,服务可用性从99.2%提升至99.9%。你将看到完整的YAML配置、踩坑记录和性能对比数据。

阿哲_Geek 1099 246 0 2026-08-01
7B模型单卡LoRA微调实录:显存从24G降到9.8G的QLoRA配置与Loss曲线分析

7B模型单卡LoRA微调实录:显存从24G降到9.8G的QLoRA配置与Loss曲线分析

上周用一张RTX 3090对Llama-2-7B做医疗问答指令微调,尝试了LoRA和QLoRA两套方案。最终QLoRA在24G显存下将batch size从4提到16,训练速度反而提升18%,微调后模型在自建医疗QA测试集上的ROUGE-L从0.21涨到0.37。本文记录完整的数据准备、bitsandbytes配置、Peft训练代码,以及两轮微调中遇到的loss震荡和OOM问题,附上实测的loss

旷野独行 1117 244 0 2026-08-01
LangChain与AutoGPT双引擎:手写Agent核心四要素实现剖析

LangChain与AutoGPT双引擎:手写Agent核心四要素实现剖析

当AutoGPT的递归循环撞上LangChain的Tool抽象,一个具备自我纠错能力的Agent需要处理多少细节?本文基于langchain==0.1.0与autogpt==0.4.0,手写一个130行核心代码的Agent,实测在12个工具调用场景下,错误处理率从72%提升至96%,记忆检索耗时从850ms压降至210ms。我们将拆解工具定义的模式匹配陷阱、短期记忆的LRU淘汰策略、以及循环控制中

路过的前端日常 1012 239 0 2026-07-31
Docker Compose编排多服务容器:网络隔离与健康检查实战配置

Docker Compose编排多服务容器:网络隔离与健康检查实战配置

本文分享一个生产环境可用的docker-compose配置,包含Nginx反向代理、Spring Boot应用、PostgreSQL和Redis四个服务。重点解决三个痛点:如何通过自定义网络实现服务隔离与通信、如何用volume卷挂载持久化数据、如何用healthcheck控制启动顺序。配置采用Compose 3.8语法,在Docker 24.0.4环境下验证通过,服务启动时间从手动部署的3分20

企业级自动化开发日志 1003 236 0 2026-07-31
LangChain 0.3手写Agent:工具注册与记忆回收机制实现

LangChain 0.3手写Agent:工具注册与记忆回收机制实现

上周在项目里用AutoGPT框架搭了个客服机器人,结果token消耗日均$47,且对话超过5轮后上下文窗口直接爆掉。这周狠下心来用LangChain 0.3.1从零手写了一个轻量Agent,核心实现了工具注册表、基于时间衰减的记忆管理器、以及带指数退避的错误重试循环。最终在128轮压力测试下,上下文占用稳定在4.2K tokens以内,回答准确率从62%提升至89%。本文直接贴出关键代码和踩坑记录

小禾Coder手记 1198 258 0 2026-07-31
Prompt Engineering调优实录:用Claude-3.5-Sonnet把SQL生成准确率从71%拉到94%

Prompt Engineering调优实录:用Claude-3.5-Sonnet把SQL生成准确率从71%拉到94%

在开发一个自然语言转SQL(NL2SQL)的内部工具时,我花了整整两周时间死磕Prompt。从最初的“一句话+表结构”到最终的“角色扮演+Few-shot+思维链+格式锁定”,在1200条测试集上,SQL生成准确率从71.3%提升至94.1%,单次查询的token消耗从2.1k降至1.4k(得益于结构化输出和长度控制)。本文将完整记录这轮实验过程:5个不同版本的Prompt设计、各自的token开

稳步前行商业成长记 1066 244 0 2026-07-31
Docker Compose多服务编排:网络隔离、健康检查与启动顺序实战

Docker Compose多服务编排:网络隔离、健康检查与启动顺序实战

上周我把一个由Nginx、Spring Boot 3.2、PostgreSQL 16和Redis 7组成的微服务demo从单机脚本迁移到docker-compose,解决了三个棘手问题:服务启动竞态导致连接失败、容器重启后IP漂移、以及健康检查误判。本文分享这套配置,包含自定义网络、命名卷、依赖条件和healthcheck,并给出具体的性能对比数据——迁移后冷启动时间从42秒缩短到18秒,内存占用

小苏_Open 1122 273 0 2026-07-31
Git分支策略与Code Review流水线:支撑200人团队的协作方案

Git分支策略与Code Review流水线:支撑200人团队的协作方案

当团队从20人扩张到200人,原先的Git分支模型彻底崩溃——频繁的merge冲突、代码评审流于形式、CI构建排队超过40分钟。本文基于Git 2.39和GitLab 15.11,分享一套经过双11大促版本迭代验证的分支策略(Trunk-based + Release Branch混合模型)、基于Merge Request的强制Code Review规则,以及通过GitLab CI + Argo

认真做交互拆解所 1028 232 0 2026-07-31
Docker Compose编排实践:多服务依赖、健康检查与卷挂载配置详解

Docker Compose编排实践:多服务依赖、健康检查与卷挂载配置详解

本文基于Docker Compose v2.24.2,分享一个包含Nginx、Golang API、PostgreSQL、Redis四服务的生产级编排配置。重点解决服务启动顺序、健康检查失效、卷权限导致的启动失败三大问题。通过实际压测数据对比,健康检查机制使服务可用性从82%提升至99.5%,容器启动总耗时从45秒缩短至28秒。文章提供完整可运行的compose文件,并详细分析每条配置的设计意图。

认真做交互拆解所 1043 238 0 2026-07-31
FastAPI与Flask性能调优实录:Profiling、SQL优化与Redis缓存三层递进

FastAPI与Flask性能调优实录:Profiling、SQL优化与Redis缓存三层递进

一个分页接口从平均响应1200ms降到87ms,吞吐量从85 QPS提升到420 QPS。文章记录了在Python 3.10 + FastAPI 0.104 + SQLAlchemy 2.0 + PostgreSQL 15环境下,对一个电商订单列表API的完整调优过程。从cProfile火焰图定位到N+1查询和JSON序列化瓶颈,通过Eager Loading、索引优化、Redis缓存(TTL 5

一线数据分析笔记 979 227 0 2026-07-31
Git Flow与Trunk Based双轨制:200人团队分支策略与CI/CD联动实践

Git Flow与Trunk Based双轨制:200人团队分支策略与CI/CD联动实践

在某中型研发中心(200+工程师),我们曾因Git分支混乱导致每周平均3次误合并、发布窗口长达4小时。本文记录我们如何将Git Flow与Trunk Based Development按业务场景混合落地,配合GitLab MR(Merge Request)强制Code Review流水线,以及Jenkins + Argo CD的CI/CD联动。文中提供完整的`.gitlab/merge_reque

小许_ReactLab 1031 239 0 2026-07-31
Prompt Engineering调优实录:从7.2%到91.4%的RAG问答准确率跃升

Prompt Engineering调优实录:从7.2%到91.4%的RAG问答准确率跃升

本文记录了一个基于LlamaIndex+GPT-4o的RAG问答系统在Prompt迭代中的完整过程。通过6轮结构化Prompt实验,对比了零样本、少样本、Chain-of-Thought及角色约束等策略对检索问答准确率的影响。实测数据表明,融合“角色限定+输出格式约束+动态示例”的Prompt方案将准确率从基线7.2%提升至91.4%,单次查询Token消耗从2431降至1187,响应延迟降低41

云端飞鸟正在学习日记 1142 256 0 2026-07-31
上一页 1 2 3 ... 20 21 22 ... 25 26 27 下一页

作者推荐