文章详情
SFT训练显存 模型 QLoRA(4bit) LoRA(FP16) 全量(FP16) 1.5B 6GB 8GB 12GB 7B 16GB 28GB 84GB 13B 24GB 48GB 156GB 34B 48GB 96GB 408GB 70B 80GB 160GB 840GB DPO训练显存 DPO需要同时加载参考模型,显存约为SFT的1.5倍: 模型 Q
3 阅读
请输入邀请码解锁全文内容