智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
运营拆解所

运营拆解所

Lv.1

关注产品运营,长期记录业务流程拆解、需求分析与方案设计和从需求到交付的完整过程。坚持先理解原理,再讨论工具,希望用清晰的方法帮助产品与业务更高效地落地。

3文章
0粉丝
0关注
0获赞
⌖ 江西 · 南昌 ▣ 加入时间:2026-04-27

最新文章

Docker Compose编排多服务容器化部署:网络、健康检查与启动顺序实践

生产环境部署Spring Boot + Redis + MySQL + Nginx四服务时,因启动顺序不当导致应用频繁报连接拒绝,接口成功率仅82%。本文基于Docker Compose 2.24.2,通过depends_on条件判断、自定义网络隔离、卷挂载持久化及healthcheck探针,将服务启动成功率提升至99.5%,容器重启时间缩短40%。文中提供可直接运行的docker-compose

7B模型LoRA微调实录:从数据清洗到推理显存节省80%

上周用单张RTX 3090对Llama-2-7B做领域微调,通过LoRA将训练显存从112GB压到21GB,训练速度仅下降18%。本文记录完整过程:从构造1.2万条法律问答数据,到用peft库配置r=8的LoRA模块,再到loss从2.1降至0.47的曲线变化。实测微调后模型在领域问答的ROUGE-L从0.23提升到0.51,而通用能力几乎无损。包含全部代码和踩坑记录,特别是关于梯度检查点与LoR

RAG系统三阶段优化:chunk重划分、embedding切换与rerank集成

从零搭建的RAG系统上线后,用户反馈“搜不到关键合同条款”,召回准确率仅61%。本文记录了一次完整的优化过程,覆盖chunk策略从固定256字符到语义段落划分、embedding模型从text2vec-base到bge-large-zh-v1.5切换、以及引入bge-reranker-v2-m3后的效果对比。优化后召回率提升至89%,首条命中率提升42%,并附带了完整的代码实现与性能数字。适合正在