Toutes les news taguées avec ce sujet.
Un retour d'expérience à contre-courant : pourquoi cette entreprise a préféré supprimer son routeur LLM plutôt que de le maintenir.
Le Model Context Protocol évolue vers un transport sans état, une révision qui vise à simplifier l'intégration des serveurs MCP.
MMOE adapte les principes des MoE de LLM aux modèles de diffusion pour améliorer convergence et qualité.
Un billet de blog décortique pas à pas la logique derrière ce mécanisme d'attention, en le rendant accessible aux non-spécialistes.
L'intégration d'ontologies structurées est cruciale pour améliorer la robustesse et la précision des systèmes agents autonomes.
NVIDIA détaille comment l'architecture entourant un modèle d'IA peut faire varier les résultats de benchmark de plusieurs points, indépendamment du modèle choisi.
NVIDIA détaille l'architecture Rubin, pensée pour les workflows agentiques multi-étapes et le raisonnement à grande échelle.
Le laboratoire français détaille une architecture combinant raisonnement rapide et lent, inspirée des travaux en psychologie cognitive.
Une étude théorique décortique le rôle des skip connections et de la normalisation dans la préservation du rang des gradients au fil des couches.
IBM Research décortique les pièges du routage entre modèles d'IA et pourquoi une approche naïve atteint vite ses limites.
Allen AI revient sur les enseignements techniques tirés du développement de son agent Shippy, entre choix d'architecture et écueils pratiques.
Un essai décortique l'architecture réelle des agents IA, présentée comme trois boucles imbriquées plutôt qu'un mécanisme unique.
Une nouvelle méthode révèle que les modèles Mamba réallouent dynamiquement leurs modes d'état selon l'entrée, ouvrant la voie à un élagage plus efficace.
Le laboratoire français présente une architecture combinant réflexes rapides et raisonnement approfondi pour ses agents autonomes.
Knock détaille l'architecture de son agent IA basée sur un filesystem virtuel et Bash, une approche minimaliste qui évite la prolifération d'outils.
H Company publie un essai sur sa philosophie de développement d'agents IA, distinguant deux régimes d'action distincts.
Un guide pratique des patterns d'architecture Redis adaptés aux agents de codage autonomes, entre mémoire, coordination et persistance.
Certaines tâches ne nécessitent pas de LLM. Un plaidoyer pour savoir quand ne pas tokeniser et privilégier des approches déterministes.
Un essai de réflexion sur le compromis fondamental entre largeur (MoE, parallélisme) et profondeur (chaînes de raisonnement) dans l'architecture des modèles de langage.
Un papier arXiv propose de faire du log d'exécution le composant central des agents IA, repensant ainsi leur architecture fondamentale.
Des chercheurs proposent de découpler le flux de calcul des Transformers en deux flux distincts, améliorant l'efficacité et les performances sur les tâches en aval.