Toutes les news taguées avec ce sujet.
Anthropic dévoile une fonctionnalité permettant aux utilisateurs d'analyser et de mieux comprendre la façon dont ils interagissent avec Claude.
Des chercheurs montrent que des LLM entraînés à s'expliquer développent une introspection fidèle à leur comportement actuel, même avec des données de supervision figées.