Toutes les news taguées avec ce sujet.
Un projet open source promet d'exécuter un modèle de 125 milliards de paramètres sur une seule RTX 4090, à haute vitesse.
Un projet open source sur GitHub permet d'analyser et visualiser les traces d'exécution GPU pour le debugging de performances.
Un ingénieur de Valve présente ses optimisations pour les vieilles cartes graphiques AMD sur Linux, à l'occasion de la conférence XDC 2026.
Un outil open source indexe photos et vidéos sur macOS pour permettre une recherche sémantique frame par frame.
Un outil open source permet de faire tourner un agent de codage IA dans des environnements isolés hébergés sur son infrastructure personnelle.
Un nouveau toolkit open source vise à doter les agents de codage de capacités d'analyse de données intégrées.
AstaBrief, le modèle qui produit rapidement des rapports de recherche dans l'assistant scientifique Asta, est désormais open source.
L'éditeur de Pop!_OS exclut les contributions issues d'outils d'IA générative sur plusieurs dépôts clés de son environnement de bureau COSMIC.
Le projet Debian publie un portail dédié à l'inférence de modèles d'IA, pensé pour s'intégrer à son écosystème logiciel libre.
Un développeur dévoile ldraw-nova, un outil open source capable de générer des modèles Lego grâce à l'IA.
Un outil open source permet de faire tourner des LLM au format GGUF sur n'importe quel GPU grâce à l'API graphique Vulkan, sans dépendre de CUDA.
Salvatore Sanfilippo, créateur de Redis, lance ds4, un outil pour faire tourner des modèles de langage localement.
Allen Institute for AI publie Olmo-core 3, une infrastructure open source conçue pour entraîner des modèles Mixture-of-Experts à grande échelle.
Un projet open source recrée en Vulkan le pipeline de neural rendering de DLSS 5, indépendamment du framework propriétaire de Nvidia.
Un outil open source présenté sur Hacker News propose une couche de validation sémantique qui peut rejeter les requêtes jugées incohérentes générées par un LLM.
Une jeune pousse issue du programme YC S25 présente un moteur d'inférence qui s'optimise automatiquement pour les workflows d'agents IA.
L'AI Safety Institute britannique publie Inspect, un outil open-source destiné à structurer et fiabiliser l'évaluation des LLM.
Un projet open source montre comment entraîner un mini-transformer minimaliste extrêmement rapidement, à titre pédagogique ou expérimental.
Un projet open source propose une architecture alternative aux transformers pour les modèles de langage, entièrement codée en Rust.
NVIDIA détaille comment travail parallèle, isolation par famille de modèles et validation GPU ont façonné ce projet open source pensé pour les agents de code.
PostHog publie Jeeves, un projet explorant comment le raisonnement renforce les modèles de décision inspirés de Jev.
Un projet open source propose une couche d'orchestration au-dessus des agents IA existants, visant l'auto-amélioration récursive (RSI).
Un projet open source distribue l'inférence d'un LLM quantifié en 1,58 bit sur plusieurs microcontrôleurs ESP32-S3.
NVIDIA propose une architecture de référence pour surveiller en continu les agents IA directement au niveau matériel.
Un développeur propose un module d'analyse d'échecs pensé pour Claude Code, exploitant les capacités agentiques du modèle.
Un projet open source connecte un agent de codage IA à un tableau blanc Excalidraw pour visualiser son raisonnement en temps réel.
Un développeur propose une bibliothèque réduite à une seule fonction pour simplifier l'appel aux LLMs et modèles multimodaux.
Un outil open source ajoute une mémoire persistante à Claude Code pour conserver le contexte d'un projet entre les sessions.
Ollaya propose une approche inspirée d'Ollama pour exécuter localement des modèles de décision de type Jev, intégralement open source.
Un outil automatisé utilisant des agents IA pour optimiser le code des noyaux CUDA, cherchant à améliorer les performances d'exécution sur GPU.