Toutes les news taguées avec ce sujet.
Do Inference Now Deploy, collection open-source de samples C++, combine ONNX Runtime et TensorRT RTX pour déployer des modèles en local.
Malgré les restrictions à l'export américaines, un commerce parallèle de puces IA avancées persisterait et contournerait les contrôles imposés à la Chine.
NVIDIA dote sa plateforme DOCA de compétences spécialisées pour agents IA, afin de fiabiliser le développement sur ses DPU BlueField.
NVIDIA lance deux outils pour accélérer et sécuriser l'accès au stockage fichier et objet à grande échelle pour les workloads IA.
NVIDIA détaille le fine-tuning de son modèle Nemotron pour améliorer la reconnaissance vocale des dialectes arabes régionaux, souvent mal couverts par les benchmarks multilingues.
NVIDIA détaille le déploiement de systèmes de recommandation génératifs HSTU, qui transforment la recommandation en modélisation séquentielle.
Une nouvelle version du Blueprint Metropolis VSS vise à faciliter la construction de systèmes de compréhension vidéo à grande échelle.
Un outil de traçabilité pour repérer les chemins inefficaces des agents IA, même quand la tâche finale aboutit malgré des étapes redondantes.
Un nouvel outil de NVIDIA vise à encadrer l'accès des agents autonomes aux ressources, données et identifiants pendant leur exécution.
NVIDIA détaille comment travail parallèle, isolation par famille de modèles et validation GPU ont façonné ce projet open source pensé pour les agents de code.
Un nouveau modèle de prédiction tabulaire, fruit d'une collaboration NVIDIA-Kumo, promet un meilleur compromis entre performance et coût de calcul.
NVIDIA lance DSX MaxLPS, un système de partage dynamique de puissance pour exploiter pleinement les infrastructures GPU sous-utilisées.
NVIDIA propose une architecture de référence pour surveiller en continu les agents IA directement au niveau matériel.
Un récit personnel relance le débat sur les promesses d'equity non tenues chez Nvidia, à l'heure où l'action a explosé grâce à l'IA.
Le laboratoire de recherche H Company intègre la coalition NVIDIA Nemotron, renforçant l'écosystème ouvert autour des modèles LLM de la gamme Nemotron.
NVIDIA détaille l'entraînement des architectures Mixture-of-Experts pour les modèles fondation en biologie, une alternative aux transformers denses trop coûteux à scale.
Un projet open source propose un pilote virtio permettant d'exploiter des GPU Nvidia depuis une machine virtuelle KVM avec des performances proches du natif.
NVIDIA détaille pourquoi un cluster GPU en bonne santé apparente peut quand même faire échouer un entraînement à grande échelle.
NVIDIA présente NodeWright, un outil pour automatiser la configuration et la maintenance des nœuds Kubernetes, en particulier pour les charges de travail GPU.
NVIDIA Warp et MjWarp optimisent les workflows de simulation et d'apprentissage en robotique grâce à l'accélération GPU, réduisant drastiquement les temps de calcul.
NVIDIA détaille comment son outil Topograph optimise le placement des workloads GPU en tenant compte de la topologie réseau des data centers.
NVIDIA lance Confidential Computing pour sécuriser l'inférence des LLM en production via des CVMs et GPUs chiffrés, protégeant données sensibles et modèles propriétaires.
L'accélération GPU ne suffit pas pour optimiser un graphe ROS 2 : les transferts mémoire CPU diluent les gains. NVIDIA propose une solution via Isaac ROS.
NVIDIA annonce DLSS 5 et son rendu neuronal 3D, accompagné de nouveautés pour ACE et RTX Kit destinées aux développeurs de jeux.
L'évaluation des agents IA doit dépasser la simple exactitude d'un appel d'outil pour mesurer l'exécution complète de chaînes de tâches et la récupération sur erreur.
Les besoins en calcul de l'IA générative dépassent un seul GPU. TensorRT 11.0 permet désormais d'exécuter un réseau sur plusieurs GPU via des collectifs NCCL.
L'architecture RISC-V remplace progressivement les microcontrôleurs propriétaires dans les GPU Nvidia, jusqu'à prendre en charge le pilote graphique.
NVIDIA présente AIPerf, un outil pour mesurer rigoureusement la performance d'inférence LLM au-delà des scripts artisanaux.
Installation en un clic pour exécuter un modèle de 27 milliards de paramètres sur du matériel grand public.
NVIDIA détaille un flux de travail par agents pour préparer et valider des jumeaux numériques en OpenUSD.