Retour au feed
arXiv cs.LG·

Trust but Verify: Mitigating Medical Hallucinations via Post-Hoc Adversarial Auditing and Multi-Agent Feedback Loops

Signal
72
Hype
28
En 3 lignesÉtude arXiv sur les hallucinations médicales des LLM. Système multi-agent « Trust but Verify » testant 3 familles de modèles (GPT-OSS, Llama-3, Falcon-3) sur 103 questions cliniques avec médicaments bannis. Architecture à 5 agents réduit le taux d'hallucination de 53% et force le refus approprié plutôt que la recommandation dangereuse.
Lire la source
Ton avis ?
Multi-agentsSécurité IAAlignementÉvaluationsRaisonnement

Résumé généré par Claude — vérifié par l'humain