Retour au feed
arXiv cs.AI·

Forced Deferral: Manipulating Routing Decisions in Multimodal LLM Cascades

Signal
72
Hype
25
En 3 lignesDes chercheurs découvrent une vulnérabilité dans les cascades de modèles multimodaux : une attaque adversariale (Forced Deferral Attack) manipule la confiance du modèle faible pour forcer le routage vers le modèle fort, augmentant les coûts de calcul sans modifier les réponses.
Lire la source
Ton avis ?
Sécurité IAVisionBenchmarks

Résumé généré par Claude — vérifié par l'humain