OUTILS
Qwen 3.8 27B disponible sur Cerebras à 1500 tok/s
Le modèle Qwen 2.5 72B est désormais proposé sur l'inférence Cerebras, atteignant une vitesse de 1500 tokens par seconde.
Hacker News (filtré IA)·@altertable·3 septembre 2026
Cerebras intègre le modèle Qwen 2.5 72B à son service d'inféference cloud. Cette solution affiche des performances de 1500 tokens par seconde, selon la documentation technique du fournisseur.