SAFETY · OpenAI
Vers des dossiers de sécurité pour l'entraînement des IA de pointe
OpenAI publie des premières lignes directrices pour justifier la sécurité de l'entraînement des modèles frontière, entre garde-fous techniques et procédures internes.
OpenAI présente des orientations préliminaires pour construire des « safety cases » lors de l'entraînement de modèles d'IA de pointe. Ces dossiers couvrent les garde-fous techniques, les pratiques opérationnelles et les méthodes d'investigation en cas d'incident de désalignement.