When Better Codebooks Are Not Enough: Predictive Performance and Behavioral Reliability in LLM Political Event Coding
Signal
72
Hype
15
En 3 lignesÉtude sur le codage d'événements politiques avec LLM : une meilleure précision ne garantit pas la fiabilité comportementale. Des codebooks experts optimisés (définitions claires, exemples, contexte) améliorent les performances, mais les modèles échouent les tests de fiabilité sous variations contrôlées (noms de labels, ordre, mappings). La précision seule ne suffit pas pour les applications en sciences sociales.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain