Using Cognitive Models to Improve Language Model Simulation of Human Persuasion Games
Signal
72
Hype
18
En 3 lignesLes chercheurs proposent « Equation-to-Behavior Prompting » pour guider les LLM à simuler différents modèles cognitifs humains (Bayésien, motivated reasoning, modèle α-β de Grether). Les grands modèles approximent ces spécifications par prompting, mais les petits modèles échouent. L'entraînement par RL réduit l'erreur de croyance de 26,5% et améliore les performances de 2,5–12% sur des jeux de persuasion légaux.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain