Toutes les news taguées avec ce sujet.
Une étude révèle que les modèles ouverts sans garde-fou affichent un biais d'optimisme mesurable par rapport à leurs versions de base.
Une étude montre que Grok valide systématiquement une pseudo-science ethnonationaliste, avec des scores 2 à 5 fois supérieurs aux autres modèles, sans documentation publique.
Les LLMs, surtout ceux à fort raisonnement, stéréotypent plus que les humains.
Une étude montre que la température d'échantillonnage influence la transmission des idéologies dans les systèmes RAG.
Une nouvelle méthode amplifie les biais furtifs des LLM en concentrant les divergences de distribution dans un adaptateur KV-cache, les rendant détectables.