Toutes les news taguées avec ce sujet.
Une nouvelle méthode de routage ajuste dynamiquement le nombre d'experts activés selon l'incertitude du modèle, token par token.
Un framework de routage au niveau de la tâche qui aligne les décisions sur les résultats finaux pour optimiser les coûts et la qualité.
Une méthode optimisée pour que les agents de codage décident, après échec, de tenter une récupération économique ou d'escalader vers un modèle coûteux.
Un outil open-source MIT pour analyser ses logs d'appels LLM et repérer les requêtes qui ne nécessitent pas un modèle coûteux.
Une approche pragmatique pour structurer les politiques de routage des agents IA à partir des pratiques agiles déjà maîtrisées par les équipes produit.