Toutes les news taguées avec ce sujet.
Un projet open source qui promet de retirer les garde-fous intégrés aux LLM, ravivant le débat sur la censure des modèles.
Une méthode de recherche montre qu'un unique prompt suffirait à retirer l'alignement de sécurité d'un LLM, sans données annotées.