Modeling Community Attitude through Reaction Tone: A Human-AI Collaborative Framework for Evaluating LLM Alignment with Linguistic Behaviors in Online Communities
CARE, un framework d'évaluation, mesure la capacité des LLM à simuler les réactions authentiques de communautés en ligne face à l'actualité. L'étude révèle un « realism gap » : les prompts explicites de communauté n'améliorent pas la fidélité de simulation. Les modèles frontière montrent des signatures comportementales divergentes.