Toutes les news taguées avec ce sujet.
NVIDIA explique comment l'architecture Groq 3 LPX améliore l'efficacité énergétique et l'interactivité de l'inférence sur sa future plateforme Vera Rubin.
Une nouvelle métrique propose d'évaluer les modèles IA non plus par leur seule performance, mais par leur efficacité énergétique en local.