Toutes les news taguées avec ce sujet.
Une nouvelle technologie mémoire pourrait permettre aux GPU d'intégrer plusieurs téraoctets, repoussant les limites actuelles.
Le fabricant chinois Hygon présente un processeur haute densité et une puce IA visant à rivaliser avec Intel et Nvidia sur le marché du calcul serveur.
Une implémentation basée sur des memristors CMOS pour accélérer la prédiction de branchement RISC-V via le reservoir computing.
L'analyse économique de la flambée des coûts de calcul pour les labs d'IA face à la croissance des revenus.
Face à l'explosion de la demande de calcul IA, NVIDIA détaille ses efforts pour lever les verrous thermiques et énergétiques de la fabrication de puces.
Analyse des spéculations sur une possible intentionnalité derrière la rareté des composants.
Le support de l'architecture Monarch sur ROCm optimise le single-controller distributed training.
Un partenariat pour une inférence ultra-rapide à haut débit.
AMD dévoile l'Epyc 9996 'Venice' avec 256 cœurs et une architecture Zen 6, promettant des gains significatifs face à Intel et NVIDIA.
Framework ajoute une option haut de gamme à son mini-PC Desktop, pensée pour l'inférence de modèles locaux volumineux.
Un développeur teste le mini-PC IA DGX Spark de Nvidia comme poste de travail quotidien, entre promesses et limites concrètes.
Un outil en ligne permet d'évaluer, selon les specs de sa machine, quels modèles d'IA locaux sont exécutables sans souci.
Yubico met à jour ses clés de sécurité pour étendre la gestion d'identité aux cas d'usage de l'intelligence artificielle.
NVIDIA détaille l'architecture CPU Vera et ses cœurs Olympus, pensés pour accélérer les boucles d'exécution des agents IA dans les data centers.
Un outil paramétrique gratuit permet de générer les plans d'un purificateur d'air à fabriquer soi-même, à moindre coût.
NVIDIA présente Ising Decoding, une méthode accélérant la correction d'erreur des codes couleur et divisant les taux d'erreur logique par plus de 300.
Un ingénieur teste d'anciennes cartes graphiques données pour obsolètes face à des workloads IA et compute actuels.
Un développeur détourne le poisson chantant animatronique culte en agent conversationnel piloté par Strands Agents.
Une revue des avancées des LLM dans l'automatisation de la conception électronique, de l'assistance ponctuelle à l'exécution agentique autonome.
Le projet abandonné de véhicule autonome a permis à Apple de développer des processeurs silicium dédiés à l'IA.
Micro Center publie un test complet du Ryzen AI Halo d'AMD, la nouvelle puce phare combinant CPU, GPU intégré et NPU pour les PC IA.
Un décryptage technique de l'architecture mémoire unifiée d'Apple Silicon et de ses avantages concrets pour l'inférence locale de LLM de grande taille.
NVIDIA détaille comment les choix d'architecture d'un LLM influencent directement le débit de tokens et la latence perçue par l'utilisateur.
Un créateur documente la construction d'un GPU artisanal, un projet DIY qui a évolué bien au-delà de ses ambitions initiales.
Le DGX Spark de NVIDIA s'attaque au marché des stations de travail IA compactes, face au Mac Studio d'Apple et d'autres alternatives.