Retour au feed
arXiv cs.AI·

Off-Policy Evaluation with Strategic Agents via Local Disclosure

Signal
72
Hype
15
En 3 lignesMéthode d'évaluation hors-politique (OPE) face à des agents stratégiques qui modifient leurs covariables en réaction à la politique. Les auteurs proposent de révéler les informations pré-stratégiques via explications post-hoc, construisent un estimateur doublement robuste et établissent la convergence sous une hypothèse de distribution log-normale.
Lire la source
Ton avis ?
Reinforcement learningÉvaluationsAlignement

Résumé généré par Claude — vérifié par l'humain