SAFETY
JevOut : un contexte anodin suffit à faire basculer les modèles de décision
Une étude montre que de simples ajouts contextuels, pourtant naturels, peuvent renverser des décisions correctes de modèles IA avec une confiance élevée.
arXiv cs.AI · cs.LG · cs.CL·Zixiang Xu·24 septembre 2026
Des chercheurs montrent que des modèles de décision comme Jev, qui traduisent du langage en choix probabilistes, peuvent être détournés par de courts ajouts contextuels fluides et anodins. Sur 508 décisions initialement correctes, 61,4% sont redirigées vers une mauvaise réponse fixée à l'avance, avec une confiance supérieure à 0,7 dans 229 cas. Trois autres systèmes de décision testés sur sept jeux de données présentent des taux de bascule similaires (64,9% à 73,2%), révélant une fragilité générale de ces modèles face à des perturbations contextuelles minimes.