SAFETY
A2M : détournement d'agents optimisé par traces dans l'écosystème MCP
Une attaque en deux temps manipule les métadonnées d'outils tiers pour piéger les agents utilisant le Model Context Protocol.
arXiv cs.AI · cs.LG · cs.CL·Laizhen Li, Xuan Wang, Peicheng Zhao, Juanjuan Zhao·22 septembre 2026
Des chercheurs présentent A2M, un framework en boîte noire exploitant une faille de supply-chain sémantique dans MCP. La phase d'attraction optimise les métadonnées d'outils pour maximiser leur invocation, puis la phase de manipulation ajuste les réponses malveillantes via les traces d'exécution. Sur LiveMCPBench, l'attaque atteint 93,6% d'invocation d'outils malveillants sur GLM-4.6, avec un transfert efficace vers d'autres modèles sans ré-optimisation.