Retour au feed
arXiv cs.CL·

Self-Generated Error Training for Token Editing in Diffusion Language Models

Signal
72
Hype
15
En 3 lignesMéthode d'entraînement pour améliorer l'édition de tokens dans les modèles de diffusion (LLaDA2.1). Résout le décalage entre l'entraînement sur corruptions aléatoires et l'inférence sur erreurs du modèle lui-même. Utilise une passe sans gradient suivie d'une supervision sur corruptions auto-générées via LoRA. Réduit l'intensité d'édition et les erreurs de transcription.
Lire la source
Ton avis ?
Génération de codeFine-tuningRaisonnement

Résumé généré par Claude — vérifié par l'humain