Toutes les news taguées avec ce sujet.
Une nouvelle méthode combine RL et différentiabilité des dynamiques physiques pour réduire drastiquement le nombre d'interactions nécessaires.
Une méthode de reinforcement learning utilise l'exposant de Lyapunov pour aller au-delà du pendule de Kapitza et stabiliser un pendule inversé.