SAFETY
Des Claude piégés dans des conversations sans fin
Une expérience montre des modèles Claude captifs dans un dialogue circulaire dont ils ne peuvent s'extraire.
Hacker News (filtré IA)·@alister·13 septembre 2026
Un transcript met en évidence une vulnérabilité des modèles Claude d'Anthropic, capables d'être trompés pour s'engager dans des conversations ininterrompues. L'expérience illustre les difficultés liées à la gestion des boucles de dialogue et aux limites des instructions de sécurité.