Toutes les news taguées avec ce sujet.
H Company détaille un problème récurrent de fuite de mémoire GPU et propose des pistes pour traquer ces "fantômes" de VRAM non libérée.
Un nouveau benchmark évalue la mémoire des agents via l'accomplissement de tâches réelles, en intégrant coût et latence, pas seulement la précision.
Un nouveau modèle génère des explorations vidéo cohérentes sur plusieurs minutes grâce à une mémoire 3D interrogeable par point de vue.
Une couche zéro-paramètre entre récupération et génération réduit les hallucinations dues aux mémoires contradictoires de plus de 56%.
Une méthode entraîne un token de mémoire compact à partir de VLM, évitant leur usage coûteux au moment de l'exécution des tâches robotiques.
Un nouveau framework identifie et neutralise les souvenirs nuisibles dans la mémoire des agents LLM, sans les supprimer définitivement.
L'appétit des géants du cloud pour la mémoire destinée à l'IA provoque une pénurie de RAM qui touche smartphones, PC et consoles.
Un outil open source promet une mémoire persistante et locale, compatible avec plusieurs interfaces en ligne de commande basées sur l'IA.
Un projet open source propose de stocker la mémoire des agents de codage IA directement dans Git, sans base de données externe.
NVIDIA présente un agent « Chief of Staff » qui conserve un modèle de soi lisible pour contextualiser son travail en entreprise dans la durée.
Un nouvel outil open-source pour doter les agents codeurs d'une mémoire durable et contrôlée par l'utilisateur.