Toutes les news taguées avec ce sujet.
Une méthode d'attribution de crédit au niveau des tokens améliore la robustesse du raisonnement des LLM entraînés par RLVR.
Un nouveau framework combine LLM et alignement spectral pour inférer le sentiment humain malgré des modalités manquantes ou bruitées.
Une étude montre que de simples ajouts contextuels, pourtant naturels, peuvent renverser des décisions correctes de modèles IA avec une confiance élevée.
Renommer les options d'un modèle de décision typé inverse massivement ses prédictions. Le modèle s'appuie sur le nom de l'option, ignorant la rubrique qui définit son sens réel.
Des chercheurs proposent un cadre théorique unifiant les méthodes de régularisation contre les perturbations adversariales en RL profond.
Une simple reformulation de la consigne peut inverser le verdict succès/échec d'un modèle de récompense VLM pour une trajectoire robotique identique.