Retour au feed
arXiv cs.LG·

Can Editing 1 Neuron Fix Repetition Loops in LLMs?

Signal
78
Hype
25
En 3 lignesLes modèles Gemma 4 présentent des boucles de répétition sur les énumérations longues (taux jusqu'à 95%). Une ablation par neurone identifie quelques neurones MLP responsables : les supprimer par édition de poids élimine les boucles simples mais pas les « doom loops » (auto-correction infinie), limité par manque de connaissance plutôt que circuit supprimable.
Lire la source
Ton avis ?
GeminiPapersÉvaluationsRaisonnement

Résumé généré par Claude — vérifié par l'humain