Pretrained self-supervised speech models can recognize unseen consonants
Signal
75
Hype
15
En 3 lignesDes modèles de reconnaissance vocale auto-supervisés (Wav2Vec2, HuBERT) fine-tunés sur des langues Khoisan (G|ui, West !Xoon) reconnaissent les consonnes clics avec une précision supérieure aux consonnes non-clics, démontrant que l'auto-supervision généralise aux phonèmes rares.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain