Toutes les news taguées avec ce sujet.
Une vidéo présente Homa, un protocole réseau conçu pour remplacer TCP dans les clusters IA à très faible latence.
L'approbation réglementaire nécessaire pour l'alimentation électrique du site devrait prendre du retard, repoussant le calendrier du projet.
Une vidéo explore des alternatives matérielles aux GPU pour l'IA, remettant en question un pilier de l'infrastructure actuelle.
Un nouveau projet propose une couche de communication dédiée aux agents IA, pour structurer leurs échanges entre eux.
Quand l'IA passe du pilote à la production, la question centrale devient : comment en faire un investissement prévisible plutôt qu'une ligne de coût incontrôlable.
Comment OpenRouter est devenu l'infrastructure de routage neutre pour plus de 10 millions de développeurs face à la multiplication des modèles.
Google explore l'idée de satellites solaires équipés de puces IA pour entraîner des modèles en orbite, misant sur l'énergie solaire continue.
Les investissements colossaux dans les infrastructures IA atteignent une ampleur inédite dans l'économie américaine, selon le Wall Street Journal.
NVIDIA détaille les mécanismes de tolérance aux pannes de NVLink 6 pour limiter les interruptions dans les clusters GPU massifs.
Des chercheurs en sécurité détaillent comment ils ont pris le contrôle du dépôt GitHub de production de Baseten, une plateforme de déploiement de modèles IA.
NVIDIA détaille comment ses modèles Nemotron et la plateforme Palantir Foundry optimisent le délai entre production de silicium et mise en service des systèmes IA.
L'appétit des géants du cloud pour la mémoire destinée à l'IA provoque une pénurie de RAM qui touche smartphones, PC et consoles.
Nvidia met la main sur la plateforme de référence des modèles open-weights, un signal fort dans la course à l'infrastructure IA.
NVIDIA propose une méthode pour calibrer les ressources GPU d'inférence face aux contraintes de latence, de trafic et de budget.