Retour au feed
arXiv cs.CL·

Speaking in Self-Assessing Tongues: On the Verbalized Confidence of LLMs in Machine Translation

Signal
72
Hype
15
En 3 lignesÉtude de la fiabilité de la confiance verbalisée des LLM en traduction automatique. Cinq méthodes d'extraction de confiance par token sans accès aux signaux internes sont comparées aux probabilités prédites. Résultats : performance similaire pour la détection d'erreurs et la calibration, mais faible corrélation entre méthodes internes et verbalisées.
Lire la source
Ton avis ?
ÉvaluationsRaisonnement

Résumé généré par Claude — vérifié par l'humain