Retour au feed
arXiv cs.AI·

Using Cognitive Models to Improve Language Model Simulation of Human Persuasion Games

Signal
72
Hype
18
En 3 lignesLes chercheurs proposent « Equation-to-Behavior Prompting » pour guider les LLM à simuler différents modèles cognitifs humains (Bayésien, motivated reasoning, modèle α-β de Grether). Les grands modèles approximent ces spécifications par prompting, mais les petits modèles échouent. L'entraînement par RL réduit l'erreur de croyance de 26,5% et améliore les performances de 2,5–12% sur des jeux de persuasion légaux.
Lire la source
Ton avis ?
RaisonnementReinforcement learningÉvaluationsSécurité IAPapers

Résumé généré par Claude — vérifié par l'humain