Toutes les news taguées avec ce sujet.
Une méthode non supervisée transforme l'EEG en atomes de formes d'onde interprétables, rivalisant avec les modèles profonds avec bien moins de données.
Une étude teste si les scores d'attribution identifient vraiment les neurones causalement importants dans les LLMs, notamment pour le comportement de refus.
Un outil open-source pour rendre visibles les raisonnements internes des grands modèles de langage, présenté sur Hacker News.