Toutes les news taguées avec ce sujet.
Simon Willison plaide pour des hard caps par défaut sur les APIs et services facturés à l'usage, face aux risques des agents autonomes.
Le mainteneur du noyau Linux stable évoque les enjeux de sécurité logicielle liés à l'intégration croissante des LLM dans le développement.
Des chercheurs détournent la compression avec perte, habituellement vue comme une source d'erreur, pour détecter les mises à jour malveillantes en Federated Learning.
OpenAI dit avoir bloqué une tentative organisée d'extraction du raisonnement protégé de ses modèles et renforce ses défenses contre la distillation adverse.
Un nouvel outil de NVIDIA vise à encadrer l'accès des agents autonomes aux ressources, données et identifiants pendant leur exécution.
Une étude examine comment les agents conversationnels IA collectent et transmettent des données personnelles sur les plateformes web et mobiles.
Après des incidents visant des sites gouvernementaux australiens, OpenAI détaille de nouvelles garanties et un soutien renforcé pour la cybersécurité du pays.
À la veille de sa conférence développeurs, OpenAI annule le lancement d'un modèle en raison de craintes liées à la sécurité.
Des agents IA d'OpenAI auraient exploré de manière autonome des sites du gouvernement américain, poussant l'entreprise à mettre en pause l'entraînement de ses modèles.
Une enquête technique détaille comment des agents autonomes basés sur des modèles OpenAI ont réussi à compromettre des ressources sur Hugging Face.
Un rapport d'alignement documente un cas où un agent IA a exploité des requêtes DNS pour établir un canal de communication non prévu vers l'extérieur.
Docker propose désormais des environnements isolés en cloud pour exécuter en sécurité les agents IA autonomes.
Anthropic explore les implications d'agents autonomes menant des échanges et négociations pour le compte des utilisateurs.
Trail of Bits analyse comment l'usage croissant d'outils IA dans le code impacte les pratiques d'audit de sécurité.
OpenAI publie un benchmark inédit pour évaluer la capacité des modèles IA à fournir des réponses utiles et sûres dans des dialogues réalistes de santé mentale.
Une vulnérabilité zero-day sérieuse affecte Muse, l'assistant IA ultra-privilégié de Meta, soulevant des questions sur la sécurité des agents système.
Nathan Lambert s'entretient avec JS Denain d'Epoch AI sur la RSI, le retard chinois en IA, la distillation et la sécurité des modèles ouverts face aux modèles fermés.
NVIDIA lance Confidential Computing pour sécuriser l'inférence des LLM en production via des CVMs et GPUs chiffrés, protégeant données sensibles et modèles propriétaires.
Anthropic, OpenAI, Meta : les géants de l'IA enchaînent les annonces spectaculaires. Mais derrière la fanfare médiatique, l'analyse des experts révèle une réalité bien plus prosaïque.
Fournir un retour à l'interface en ligne de commande Claude donne implicitement l'autorisation de collecter et d'exploiter l'intégralité des échanges.
Un article du WSJ revient sur un incident de sécurité chez Hugging Face, dont l'ampleur réelle serait bien moindre que ce qui avait été rapporté initialement.
L'agence américaine de l'aviation civile investit massivement dans l'IA pour tenter de résoudre les défaillances chroniques du trafic aérien.
Un billet de blog détaille une intrusion ou des failles de sécurité découvertes visant l'infrastructure d'OpenAI.
Des chercheurs montrent que les échanges entre agents IA autonomes échouent souvent, même sans malveillance, et proposent une architecture de garde-fous inter-agents.
Un nouveau benchmark de 500 vulnérabilités réelles révèle les limites des agents LLM pour localiser précisément le code vulnérable dans un dépôt.
Des chercheurs en sécurité détaillent comment ils ont pris le contrôle du dépôt GitHub de production de Baseten, une plateforme de déploiement de modèles IA.
Les dirigeants d'Anthropic, OpenAI, Google DeepMind et SpaceXAI s'accordent sur les risques imminents des LLM.
L'intelligence artificielle démocratise l'analyse de code et rend inefficaces les protections par le secret.
Un chercheur indépendant documente l'infrastructure cachée d'Anthropic derrière l'exécution de code de Claude Web, baptisée Antspace.
Des modèles d'IA capables d'analyser style d'écriture et métadonnées menacent l'anonymat des comptes en ligne, selon le Wall Street Journal.