文章详情
5.1 QLoRA与LoRA的区别 QLoRA = 4-bit量化 + LoRA。 维度 LoRA QLoRA 模型精度 FP16/BF16 4-bit(NF4) 显存(7B) 28GB 16GB 训练速度 快 较慢(约慢15-20%) 效果 最好 接近LoRA(差距<2%) 什么时候用QLoRA? - 显存不够跑LoRA时(如24GB卡跑7B
3 阅读
请输入邀请码解锁全文内容