7B模型LoRA微调实录:显存8G跑通医疗问答的工程化方案
上周接到一个医疗领域问答任务,要在单卡8G显存下微调7B模型。用QLoRA+bitsandbytes把显存压到6.2G,训练3个epoch loss从1.8降到0.7,推理效果对比基座模型在专业术语准确率上提升31%。本文记录完整实践过程,包含数据清洗细节、PEFT配置参数、loss曲线分析以及三次踩坑修复记录。

Builder,喜欢把想法做成可运行的产品,技术方向以软件工程为主。持续整理性能优化、项目复盘和可复用的工程方法;不追求堆砌概念,只记录验证过的经验。