Retour au feed
arXiv cs.AI·

The Hidden Power of Scaling Factor in LoRA Optimization

Signal
72
Hype
18
En 3 lignesÉtude théorique et empirique du facteur d'échelle α en LoRA. Les auteurs montrent que α domine l'optimisation bien plus que le learning rate, via un framework Signal-Drift. Ils découvrent une loi de racine carrée reliant α au rang et proposent LoRA-α pour améliorer les performances et simplifier l'ajustement d'hyperparamètres.
Lire la source
Ton avis ?
Fine-tuningRaisonnementPapers

Résumé généré par Claude — vérifié par l'humain