Retour au feed
arXiv cs.CL·

Does AI Reviewer See the Full Picture? Attacking and Defending Multimodal Peer Review

Signal
78
Hype
25
En 3 lignesPaperGuard, un benchmark multimodal, évalue la vulnérabilité des LLMs et MLLMs aux attaques adversariales dans l'examen par pairs scientifique. Les chercheurs testent des injections de prompts et perturbations (GCG, PGD) sur texte et figures, proposant une défense par recherche d'embeddings par chunks pour localiser les instructions malveillantes.
Lire la source
Ton avis ?
Sécurité IAAlignementVisionBenchmarksÉvaluations

Résumé généré par Claude — vérifié par l'humain