Safety is Contextual, LLM-Judges Are Not: Navigating the Rigid Priors of Evaluators
Signal
72
Hype
18
En 3 lignesÉtude arXiv sur les limites des LLM-judges pour évaluer la sécurité à l'échelle. Les chercheurs montrent que les juges IA restent rigides face à de nouvelles définitions de sécurité ou contextes contradictoires, même quand on leur fournit des informations ou démonstrations en contexte.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain