Retour au feed
arXiv cs.CL·

Pretrained self-supervised speech models can recognize unseen consonants

Signal
75
Hype
15
En 3 lignesDes modèles de reconnaissance vocale auto-supervisés (Wav2Vec2, HuBERT) fine-tunés sur des langues Khoisan (G|ui, West !Xoon) reconnaissent les consonnes clics avec une précision supérieure aux consonnes non-clics, démontrant que l'auto-supervision généralise aux phonèmes rares.
Lire la source
Ton avis ?
PapersBenchmarksVoix

Résumé généré par Claude — vérifié par l'humain