智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
每天进步一点商业成长记

每天进步一点商业成长记

Lv.1

以项目为主线推进长期学习。当前重点关注商业分析,通过业务流程拆解、商业价值验证持续提升能力;更关注能够真正落地的方法,并把过程整理成可复用的学习记录。

3文章
0粉丝
0关注
0获赞
⌖ 四川 · 成都 ▣ 加入时间:2026-04-12

最新文章

向量数据库选型:Milvus与Qdrant在百万级影视素材检索中的实测对比

在影视素材库的以图搜图业务中,我们对比了Milvus 2.4.1与Qdrant 1.9.2在百万级768维向量下的表现。Qdrant在单机部署上节省了约40%内存,查询P95延迟低至12ms,而Milvus在批量写入吞吐上领先35%。本文记录了两者的Docker部署、Python客户端代码、HNSW参数调优过程,以及一次关于内存溢出的惨痛踩坑经历,希望能为同样在做向量检索选型的朋友提供一份量化参考

React 19与Vue 3.5状态管理迁移实录:从Props钻透到Zustand/Pinia

在维护一个3万行代码的中台项目时,我们因Props层层透传和Context频繁重渲染导致页面卡顿——首屏渲染时间从1.2s恶化到2.8s,组件更新时CPU占用飙升至80%。本文记录我们将React 19与Vue 3.5双技术栈项目从本地State/Context迁移至Zustand 5和Pinia 3的全过程:包含方案选型对比(含性能基准测试数据)、分步迁移策略(细粒度状态切片)、以及迁移后渲染次

LoRA微调7B参数模型显存压测与推理效果对比实践

当业务需要把7B模型适配到特定领域时,全参微调需要近60GB显存,而LoRA只需16GB。本文基于Baichuan2-7B-Chat,使用PEFT+bitsandbytes完成QLoRA微调,在单张RTX 4090上从数据清洗到loss收敛全程记录。实测显存峰值15.7GB,训练3万步后,领域问答准确率从基线41.2%提升至78.6%,而单次推理延迟仅增加3ms。文中会给出可直接复跑的完整代码,并