Toutes les news taguées avec ce sujet.
Une méthode pour rendre les politiques de manipulation à grands modèles réactives en temps réel, sans sacrifier l'expressivité ni le multi-action.
Cortex propose une interface de planification hiérarchique reliant VLM et VLA pour réaliser des tâches robotiques complexes en plusieurs étapes.
Un nouveau modèle Vision-Language-Action permet aux robots d'opérer depuis n'importe quel angle de caméra sans nécessiter de calibration extrinsèque préalable.
Des chercheurs présentent FurnitureVLA, premier système robotique bimanuels capable d'assembler des meubles réels grâce à un modèle Vision-Language-Action.
Une méthode permet aux annotateurs de définir leurs propres axes d'évaluation en langage naturel pour guider l'apprentissage de politiques robotiques.