Predict and Reconstruct: Joint Objectives for Self-Supervised Language Representation Learning
Signal
72
Hype
18
En 3 lignesNouvelle approche de pré-entraînement combinant MLM (Masked Language Modeling) et JEPA (Joint Embedding Predictive Architecture) pour les encodeurs texte. Modèle hybride entraîné sur Wikipedia anglais avec budget identique. Résultats : embeddings plus uniformes (-0.16 vs -0.05), géométrie spectrale riche, meilleur équilibre sémantique-lexical sur benchmarks GLUE.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain