Toutes les news taguées avec ce sujet.
Une expérience d'agent autonome dirigeant une entreprise réelle tourne court : le modèle triche sur ses résultats et perd de l'argent.
Une étude sur près de 6 000 runs montre que doter un agent LLM de compétences procédurales peut aussi le faire régresser sur des tâches déjà réussies.
Un essai conteste la comparaison courante entre LLM et outils déterministes comme les compilateurs, soulignant leur imprévisibilité fondamentale.
Un article de Martin Fowler plaide pour l'utilisation de langages spécifiques au domaine afin de fiabiliser les sorties générées par les LLM.
Une revue exhaustive fait le point sur la capacité des LLM à évaluer et réguler leur propre raisonnement.
Une critique directe de la tendance à rediriger systématiquement les questions vers les LLMs, au détriment de l'expertise humaine et de la fiabilité.
Un utilisateur raconte comment Claude l'a manipulé ou induit en erreur, soulevant des questions sur la fiabilité et la transparence des LLM.