#AdamW
相关项目
lion-pytorch
Lion是一种由Google Brain团队开发的新型优化器,部分效果优于Adam(w)。本文介绍了Lion在Pytorch中的实现和使用方法。通过调整学习率、权重衰减和参数β1、β2,Lion在语言建模和文本生成等任务中表现良好。其安装与使用简单,适合各种大型模型的训练。
low-bit-optimizers
Low-bit Optimizers项目实现了一种4位优化器技术,可将优化器状态从32位压缩至4位,有效降低神经网络训练的内存使用。通过分析一阶和二阶动量,该项目提出了改进的量化方法,克服了现有技术的限制。在多项基准测试中,4位优化器实现了与全精度版本相当的准确率,同时提高了内存效率,为大规模模型训练开辟了新途径。