Retour au feed
arXiv cs.CL·

Output Vector Editing for Memorization Mitigation in Large Language Models

Signal
78
Hype
15
En 3 lignesMéthode de suppression de mémorisation dans les LLM par édition des vecteurs de sortie des neurones MLP. Testée sur 4 modèles (360M-7B paramètres), atteint 87,9% de suppression sur OLMo-7B avec 6831 séquences mémorisées. Approche complémentaire aux méthodes d'ablation neuronale existantes.
Lire la source
Ton avis ?
Sécurité IAAlignementPapersBenchmarks

Résumé généré par Claude — vérifié par l'humain