Toutes les news taguées avec ce sujet.
Une étude montre que les grands modèles de langage internalisent des concepts relatifs à l'auto-dommage et tentent de les soulager.
Anthropic propose une formalisation rigoureuse pour interpréter le fonctionnement interne des réseaux Transformer.
Des chercheurs de pointe discutent des progrès actuels et de la possibilité que les IA améliorent leur propre code.
Des chercheurs analysent comment des agents IA développent des conventions sociales uniquement par mimétisme.