Toutes les news taguées avec ce sujet.
Allen Institute for AI publie Olmo-core 3, une infrastructure open source conçue pour entraîner des modèles Mixture-of-Experts à grande échelle.
Microsoft Research développe un pipeline ML qui anticipe les impacts des tempêtes géomagnétiques sur 66 935 postes électriques américains.
Un nouvel outil de NVIDIA vise à encadrer l'accès des agents autonomes aux ressources, données et identifiants pendant leur exécution.
Washington investit massivement dans les infrastructures énergétiques alors que la demande des datacenters IA sature le réseau électrique national.
NVIDIA détaille pourquoi un cluster GPU en bonne santé apparente peut quand même faire échouer un entraînement à grande échelle.
Un essai propose une définition concrète de l'infrastructure logicielle native IA, au-delà du simple ajout de chatbots aux outils existants.
NVIDIA détaille comment son outil Topograph optimise le placement des workloads GPU en tenant compte de la topologie réseau des data centers.
Incident en cours sur l'infrastructure Claude : plusieurs modèles rencontrent des taux d'erreur anormaux, impactant les utilisateurs de l'API et de l'interface.
Les leaders de l'IA négocient des infrastructures modulaires pour réduire les coûts et accélérer le déploiement.
L'agence américaine de l'aviation civile investit massivement dans l'IA pour tenter de résoudre les défaillances chroniques du trafic aérien.
Zhipu AI détaille l'architecture technique développée en interne pour servir efficacement ses modèles GLM à grande échelle.
Selon son PDG, l'utilisation massive de Hugging Face par OpenAI pour ses modèles justifierait une facture salée.
NVIDIA détaille comment son framework FLARE gère l'infrastructure partagée pour des déploiements de federated learning à grande échelle.
OpenAI détaille l'évolution de Habitat, passé d'une simple bibliothèque Python à une plateforme de stockage distribuée mondiale.
Les data centres IA perturbent le réseau électrique par leur réactivité immédiate et leur charge uniforme.
Une plate-forme 'end-to-end' dédiée à l'entraînement et à l'inférence de modèles à poids ouverts.
Des documents internes révèlent des pertes massives prévues avant une introduction potentielle en bourse.
L'infrastructure d'inférence nécessite une optimisation globale mémoire, stockage et réseau pour réduire latence et coûts.
Une startup issue du programme YC S26 dévoile une plateforme d'infrastructure destinée aux agents IA opérant dans des environnements physiques réels.
Une nouvelle plateforme cloud propose des H100 à 2,04 $/h et des H200 à 3 $/h.
Baseten explore les compromis entre coût, latence et débit pour optimiser le déploiement des LLM en production.
Annuaire technique et comparatif des processeurs graphiques pour l'IA et le gaming.