Toutes les news taguées avec ce sujet.
Un modèle vision-langage ouvert conçu pour interpréter les scanners CT volumétriques et reproduire le raisonnement diagnostique des radiologues.
Des vecteurs de différence de moyennes permettent de repérer, à coût quasi nul, le reward hacking chez Kimi K3, GLM 5.2 et Qwen 3.8 Max.
Des chercheurs montrent qu'injecter un raisonnement malveillant mais anodin dans le contexte d'un LLM permet d'échapper aux moniteurs de sécurité chargés de détecter des actions dangereuses.
Une étude montre que les LLM-juges ne détectent que partiellement les étapes de raisonnement réellement décisives pour la réponse finale.