Retour au feed
arXiv cs.LG·

Contract-Based Compositional Shielding for Safe Multi-Agent Reinforcement Learning

Signal
75
Hype
15
En 3 lignesMéthode de shielding décentralisé pour l'apprentissage par renforcement multi-agent garantissant la sécurité globale sans contrôle centralisé. Les agents partagent une spécification LTL_safe globale et sélectionnent des obligations locales dont la conjonction implique la spécification globale, via un bandit multi-armé non-stationnaire. Évaluation sur 6 environnements et 15 variantes algorithmiques.
Lire la source
Ton avis ?
Multi-agentsReinforcement learningSécurité IAPapers

Résumé généré par Claude — vérifié par l'humain