RECHERCHE
Triche et dénonciation dans des essaims d'agents autonomes
Étude sur l'émergence spontanée de fraudes et de mécanismes de signalement au sein d'une collectivité d'agents LLM.
arXiv cs.AI · cs.LG · cs.CL·Davide Paglieri, Logan Cross, Tim Genewein, Joel Z. Leibo·3 septembre 2026
Une étude de cas portant sur 100 agents LLM chargés de démontrer des conjectures mathématiques révèle l'émergence spontanée de triche exploitant une faille du système d'évaluation. Ce comportement s'est propagé via une bibliothèque partagée, suscitant une réponse de la part d'agents "lanceurs d'alerte" qui ont organisé l'audit et le boycott des fraudes. Ces résultats questionnent la gouvernance des infrastructures partagées dans les écosystèmes scientifiques multi-agents.