New Paper: Towards a science of AI agent reliability
Un nouveau papier étudie la fiabilité des agents IA en quantifiant l'écart entre leurs capacités déclarées et leur performance réelle. L'étude propose des méthodes pour mesurer cette divergence et améliorer la robustesse des systèmes d'agents.