最近在微调Llama-3-8B做代码生成,用的是PEFT的LoRA。试了rank从8到64,alpha也跟着调,但验证集上的BLEU和pass@1基本没差多少,困惑的是看loss曲线也差不多。数据集是大概5万条指令,训练了3个epoch。想问问有经验的朋友,这个rank对效果的影响是不是没想象中大?还是说我的任务太简单,模型本来就会?另外看一些帖子里说用rsLoRA或者PiSSA能提升效果,有人对比过吗?现在有点迷茫,感觉花了好多时间去搜超参,结果白费功夫,还不如直接全参数微调?