文章详情
v0.8+新功能 KTO支持:只需好/坏标签的偏好学习 ORPO支持:SFT+对齐一步完成 SimPO支持:无需参考模型的偏好优化 LoRA+支持:A和B使用不同学习率 rsLoRA支持:秩稳定LoRA 多模态训练:LLaVA风格视觉语言模型 Galore优化器:新的参数高效优化方法 BAdam优化器:内存高效的块坐标优化 如何升级 升级后检查: - dat
6 阅读
请输入邀请码解锁全文内容