Stop When Further Reasoning Won't Help: Attention-State Adaptive Generation in Reasoning Models
Signal
72
Hype
28
En 3 lignesASAG, une méthode sans entraînement basée sur l'analyse des distributions d'attention, détecte le surapprentissage dans les modèles de raisonnement et arrête la génération de manière adaptative. Testé sur DeepSeek-R1-Distill et Qwen3, elle améliore la précision de 3,2% tout en réduisant les tokens générés de 40% sur Qwen3-8B.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain