Toutes les news taguées avec ce sujet.
13,6% des instances de SWE-bench Verified présentent un décalage entre pull request et issue, faussant l'évaluation des LLM sur la résolution de bugs.
Un développeur implémente un agent fonctionnel avec appels d'outils en seulement 100 lignes de Lisp, démontrant la concision du langage pour ce cas d'usage.
Kastra.ai propose un outil d'enforcement de politiques pour encadrer l'usage des assistants de code IA en entreprise.
Un outil en ligne de commande combine LLM et analyse syntaxique (AST) pour générer des visualisations structurées d'une base de code.
xAI intègre Grok 4.5 à l'éditeur de code Cursor, élargissant encore l'offre de modèles accessibles aux développeurs.
Un développeur teste onze LLMs sur une tâche concrète de refactoring de code LangGraph, révélant des écarts significatifs de performance.