Natively Unlearnable Large Language Models
Signal
78
Hype
25
En 3 lignesNULLs (Natively Unlearnable LLMs) est une architecture qui isole les contributions de chaque source de données dans des paramètres distincts (sinks) tout en conservant un backbone partagé. Testée sur ~6M articles Wikipedia, elle permet de désapprendre une source spécifique au déploiement sans réentraînement, tout en préservant les connaissances partagées et les capacités linguistiques générales.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain