Toutes les news taguées avec ce sujet.
Un projet open source sur GitHub permet d'analyser et visualiser les traces d'exécution GPU pour le debugging de performances.
Une vidéo explore des alternatives matérielles aux GPU pour l'IA, remettant en question un pilier de l'infrastructure actuelle.
Malgré les restrictions à l'export américaines, un commerce parallèle de puces IA avancées persisterait et contournerait les contrôles imposés à la Chine.
Un projet open source recrée en Vulkan le pipeline de neural rendering de DLSS 5, indépendamment du framework propriétaire de Nvidia.
Un article technique compare plusieurs méthodes de rendu de texte accéléré par GPU, entre qualité visuelle et performance.
NVIDIA lance DSX MaxLPS, un système de partage dynamique de puissance pour exploiter pleinement les infrastructures GPU sous-utilisées.
H Company détaille un problème récurrent de fuite de mémoire GPU et propose des pistes pour traquer ces "fantômes" de VRAM non libérée.
H Company détaille comment identifier et corriger les fuites de VRAM qui plombent l'entraînement et l'inférence des modèles.
Un projet open source propose un pilote virtio permettant d'exploiter des GPU Nvidia depuis une machine virtuelle KVM avec des performances proches du natif.
NVIDIA détaille pourquoi un cluster GPU en bonne santé apparente peut quand même faire échouer un entraînement à grande échelle.
NVIDIA présente NodeWright, un outil pour automatiser la configuration et la maintenance des nœuds Kubernetes, en particulier pour les charges de travail GPU.
NVIDIA Warp et MjWarp optimisent les workflows de simulation et d'apprentissage en robotique grâce à l'accélération GPU, réduisant drastiquement les temps de calcul.
L'architecture RISC-V remplace progressivement les microcontrôleurs propriétaires dans les GPU Nvidia, jusqu'à prendre en charge le pilote graphique.
Décryptage complet de l'architecture et des performances de la puce graphique Adreno X2 de Qualcomm.
NVIDIA détaille les mécanismes de tolérance aux pannes de NVLink 6 pour limiter les interruptions dans les clusters GPU massifs.
Un outil open source vise à faire tourner les charges CUDA de Nvidia directement sur des cartes graphiques AMD, sous Windows.
System76 lance une workstation Linux optimisée pour l'IA intégrant jusqu'à 192 Go de mémoire GPU.
Une plongée technique dans les mécanismes internes d'écriture mémoire des GPU, entre caches, cohérence et performance.
BioNeMo Inference Runtime accélère la prédiction de structures biomoléculaires à grande échelle sur GPU.
NVIDIA officialise son support du Rust pour la programmation GPU native avec deux approches distinctes.
Arm promet des performances de jeu proches du desktop sur mobile grâce à un GPU pensé pour l'IA native.
Une librairie JAX accélère le calcul de gradients pour les ensembles d'équations différentielles sur NVIDIA GPU.
NVIDIA détaille une méthode concrète pour optimiser du code CUDA, entre profilage, bibliothèques modernes et bonnes pratiques de performance.
NVIDIA propose une méthode pour calibrer les ressources GPU d'inférence face aux contraintes de latence, de trafic et de budget.
Annuaire technique et comparatif des processeurs graphiques pour l'IA et le gaming.