Retour au feed
arXiv cs.CL·

Are you speaking my languages? On spoken language adherence in multimodal LLMs

Signal
72
Hype
18
En 3 lignesLes LLM pour la reconnaissance vocale multilingue confondent souvent la langue de sortie. Les auteurs proposent trois stratégies : prompting zéro-shot, fine-tuning supervisé et raisonnement Chain-of-Thought pour améliorer l'adhérence linguistique sans contraindre strictement la sortie ni perdre les capacités de code-switching.
Lire la source
Ton avis ?
VoixPrompt engineeringFine-tuningRaisonnementPapers

Résumé généré par Claude — vérifié par l'humain