7B模型LoRA微调实录:显存9.3G跑通中文医疗问答
微调7B大模型不再是A100专属。本文记录在单张RTX 3090(24G)上,用QLoRA对Qwen2-7B-Instruct进行中文医疗意图识别的完整过程。通过4-bit NF4量化,峰值显存仅9.3G;使用28万条病历对话数据,训练3个epoch后,医学问答BLEU提升22.7%,意图分类F1从0.61涨到0.88。文中提供可直接复用的LoRA配置、数据清洗脚本和推理对比样例,并踩平了PEFT

一名专注于开源技术的技术创作者。日常记录代码可维护性、开发效率提升和项目中的问题解决过程;重视可维护性、稳定性与协作效率,也会分享技术原理、工程细节和落地经验。