Retour au feed
arXiv cs.CL·

Predict and Reconstruct: Joint Objectives for Self-Supervised Language Representation Learning

Signal
72
Hype
18
En 3 lignesNouvelle approche de pré-entraînement combinant MLM (Masked Language Modeling) et JEPA (Joint Embedding Predictive Architecture) pour les encodeurs texte. Modèle hybride entraîné sur Wikipedia anglais avec budget identique. Résultats : embeddings plus uniformes (-0.16 vs -0.05), géométrie spectrale riche, meilleur équilibre sémantique-lexical sur benchmarks GLUE.
Lire la source
Ton avis ?
PapersFine-tuningEmbeddingsRaisonnement

Résumé généré par Claude — vérifié par l'humain