Retour au feed
arXiv cs.AI·

ThinkDeception: A Progressive Reinforcement Learning Framework for Interpretable Multimodal Deception Detection

Signal
72
Hype
35
En 3 lignesThinkDeception propose un cadre d'apprentissage par renforcement progressif pour la détection de tromperie multimodale interprétable. Utilisant des MLLMs, il transforme la classification binaire en processus de raisonnement explicite via Chain of Thought. VAC-GRPO avec curriculum learning stratifié en 4 niveaux de difficulté atteint SOTA sur les benchmarks.
Lire la source
Ton avis ?
RaisonnementReinforcement learningVisionÉvaluationsPapers

Résumé généré par Claude — vérifié par l'humain