RECHERCHE
Safe Meta-RL via l'accessibilité dans l'espace d'information
Un nouveau cadre de meta-reinforcement learning garantissant la sécurité lors de l'adaptation à de nouvelles tâches.
arXiv cs.AI · cs.LG · cs.CL·Zeyang Li, Sunbochen Tang, Navid Azizan·14 septembre 2026
Ce papier introduit un cadre de meta-reinforcement learning intégrant explicitement des contraintes de sécurité lors de l'adaptation. Les auteurs proposent de raisonner sur la sécurité dans un espace d'information combinant état physique et croyance de l'agent, via une fonction de valeur apprenable. Cette approche permet un filtrage de sécurité et une optimisation de politique sous contraintes, validée sur des benchmarks.