智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
体验实验场

体验实验场

Lv.1

专注于提示词工程的工程化与业务落地。持续实践RAG知识库搭建、数据治理与评测,重点关注效果、成本、稳定性和可维护性,分享经过验证的方案与真实复盘。

2文章
0粉丝
0关注
0获赞
⌖ 福建 · 福州 ▣ 加入时间:2026-05-01

最新文章

Docker Compose多服务编排:网络隔离与健康检查实战配置

本文通过一个真实的后端项目,分享基于Docker Compose v2.24编排Nginx、Spring Boot、PostgreSQL、Redis四个服务的完整配置。文中给出了带静态IP的子网划分方案、基于healthcheck的启动依赖控制、以及通过卷挂载实现日志持久化的具体参数。配置上线后,服务启动时间从手工部署的8分钟缩短至45秒,容器重启次数下降90%。适合正在从单机部署转向容器化编排的

7B模型LoRA/QLoRA微调全记录:显存从24G降到6G,效果不减反增

上周接到一个任务,要把一个7B模型适配到特定领域。全参数微调需要80G显存,我只有一张RTX 3090。折腾了四天,最终用QLoRA+LoRA组合方案,把显存压到6.2G,训练速度反而比全量微调快3倍。最关键的是,在领域测试集上,QLoRA微调后的模型比全参数微调还高出1.7个百分点的F1。这篇文章把整个过程的配置、代码、踩坑点全部摊开讲,包括数据清洗的细节、bitsandbytes的坑、以及为什