Toutes les news taguées avec ce sujet.
Une analyse suggère que les traces de chain-of-thought de Kimi K3 expliqueraient une partie de ses performances en design d'interfaces.
Un nouveau cadre transfère le raisonnement logique de modèles textuels vers des modèles audio via un alignement on-policy.
Une nouvelle méthode permet de corriger directement les erreurs de raisonnement des LLM sans tout régénérer, avec un gain de correction de 25%.
Un développeur indépendant publie Lucid, un outil qui expose et rend éditables les étapes de réflexion d'un modèle d'IA avant qu'il génère sa réponse.
Un framework open-source qui transforme la génération vidéo en mécanisme de raisonnement séquentiel, alternatif au Chain-of-Thought textuel.
Un nouveau mécanisme de récompense double pour ancrer le raisonnement des VLMs dans la réalité physique et réduire les hallucinations dans les tâches interactives.
Le framework VRRL entraîne les modèles vision-langage à corriger leurs erreurs en s'appuyant réellement sur les entrées visuelles, même hors distribution.