← 返回信息流
论文 arXiv 论文 · Jiale Kang, Ziyin Yue, Zheng Zhan, Yangyi Huang, Weiyang Liu 2026-08-31 16:15 🔥 热度 5

归一化低秩适配:NoRA让LoRA训练更稳更快

提出归一化LoRA改进参数高效微调的训练稳定性

原文:Normalized Low-Rank Adaptation

虽然低秩适配(LoRA)被广泛用于参数高效的模型适配,但如何正则化其训练动态以实现稳定有效的优化仍鲜有研究。由于LoRA将上投影矩阵初始化为零,其早期优化动态主要由下投影矩阵决定。基于这一观察,我们提出Normalized Low-Rank Adaptation(NoRA),一种简单而有效的方法,在训练过程中对下投影矩阵进行归一化。我们进一步证明,同样的归一化可以只在初始化时应用,即可在无需整个训练过程中反复归一化的情况下改进标准LoRA。在预训练、监督微调和强化学习任务中,NoRA始终能加速收敛、提升性能和训练稳定性,并缓解灾难性遗忘。这些收益既不需要额外的可训练参数,也不增加推理时计算量,使NoRA成为对LoRA的一种简单且广泛适用的增强。

查看原文 ↗ 技术论文

📌 相关阅读

218. 大模型 的训练、推理、SFT、强化学习究竟有什么区别?【每天一个宝藏问题】 热度 9 【光学小课堂第三十三期】当 AI 学会设计镜头——光学研发从"拼经验"到"拼算力" 热度 8 画面接近现实!当我把南京做进了游戏!高斯模型UE5技术演示 3DGS结合 人工智能 热度 8 自进化WAM来了!清华AIR联手域变换提出具身In-Context Causal Learning 热度 8 AIVC只是前菜!复旦提出生命算子,统一生命建模 热度 8