Toutes les news taguées avec ce sujet.
Outil de suivi en temps réel des prix des API IA et estimateurs de coûts pour charges de travail réelles.
Le laboratoire chinois publie une nouvelle version de son modèle rapide, sans détails techniques précis pour l'instant.
Le routing entre modèles d'IA émerge comme un service infrastructurel critique pour optimiser coûts et performance.
En activant la rétention du raisonnement et la compaction, GPT-5.6 voit ses performances et son efficacité fortement progresser sur ce benchmark.
Le modèle Kimi K3 est désormais accessible au travers de l'API d'inférence de Telnyx.
Une discussion technique explore ce que recouvre réellement le paramètre 'effort' proposé par certains fournisseurs de LLM.
Un recueil de notebooks et tutoriels officiels pour exploiter l'API Claude : RAG, agents, function calling et plus.
Un projet ludique propose une API permettant de simuler une pause pour les agents IA chargés de coder, entre satire et expérimentation.
Google déprécie les paramètres classiques de sampling temperature, top_p et top_k sur ses derniers modèles.
Une nouvelle extension permet de générer des recherches d'images libres de droits sur Pexels directement via Claude Code.
La start-up française dévoile une API permettant à des agents IA de piloter directement des interfaces informatiques.
Le lab français dévoile une API permettant de déployer des agents IA capables d'interagir directement avec des interfaces informatiques.
Une startup passée par Y Combinator dévoile une API destinée à faciliter le développement d'agents IA capables d'utiliser des ordinateurs.
DeepMind ouvre l'accès à deux nouveaux modèles Gemini optimisés pour la légèreté et la rapidité d'inférence.