Toutes les news taguées avec ce sujet.
APS-RAG combine recherche dense, sparse et graphe de connaissances pour interroger des décennies de savoir opérationnel d'un accélérateur de particules.
Une étude propose PAT, un système RAG combinant spécifications utilisateur et corpus comparables pour une traduction de documents entiers, au-delà de la phrase par phrase.
Un système hybride combine robotique éducative Lego WeDo2 et assistant conversationnel RAG pour enseigner les gestes de sécurité sismique aux élèves du primaire.
Le laboratoire français Pleias publie une gamme de modèles conçus spécifiquement pour les usages RAG.
Le lab français Pleias met en ligne une version quantisée GGUF de son modèle léger dédié aux tâches de retrieval-augmented generation.
Pleias publie un modèle compact de 1 milliard de paramètres, conçu spécifiquement pour les tâches de retrieval-augmented generation.
Pleias publie un modèle compact de 350 millions de paramètres, dédié aux tâches de retrieval-augmented generation.
Un plaidoyer pour repenser l'organisation de la documentation à l'ère des LLM et des agents IA qui doivent la consommer.
Plus de 216 000 compétences structurées, sourcées et vérifiables pour équiper les agents IA — la plus grande bibliothèque ouverte du genre selon ses auteurs.
Une nouvelle architecture externalise les connaissances factuelles dans une base de connaissances interrogée par vecteurs continus, surpassant GPT-4o-mini sur certains benchmarks.
Un système de production génère des commentaires stratégiques F1 multilingues en garantissant la fidélité factuelle via un vérificateur de claims intégré à l'architecture.
DynaKRAG introduit une politique apprise pour orchestrer dynamiquement les opérations de récupération de preuves dans les systèmes RAG multi-sauts.
Kapa.ai détaille sa méthode pour réduire le contexte injecté dans un pipeline RAG, en supprimant les passages superflus avant la génération.
Les générateurs d'images hallucinent ce qu'ils ignorent. Un nouveau framework co-entraînement + recherche vise à corriger ce défaut structurel.
Une analyse structurée des architectures de mémoire persistante pour agents IA, à travers trois solutions représentatives du marché.
Un développeur conteste l'approche dominante en matière de mémoire pour les agents IA : stocker des transcriptions brutes ne suffit pas.
Manticore Search détaille comment une réécriture du pipeline ONNX a multiplié par 14 la vitesse de génération d'embeddings.
PolicyGuard convertit des politiques internes en règles logiques exécutables, combinant LLM et évaluation symbolique pour auditer la conformité des documents.
Microsoft Research présente Memora, un système de mémoire scalable pour agents IA qui réduit jusqu'à 98 % les tokens de contexte tout en battant l'état de l'art sur deux benchmarks.