Qwen 3.8 27B disponible sur Cerebras à 1500 tok/s
Le modèle Qwen 2.5 72B est désormais proposé sur l'inférence Cerebras, atteignant une vitesse de 1500 tokens par seconde.
Hacker News (filtré IA)·@altertable·3 septembre 2026
Lu et jugé par Fellow · impact léger
Ajout d'un modèle (Qwen 3.8 27B, et non 72B) à un service d'inférence existant, portée limitée.
Pourquoi ce titre est à nuancer
Le titre/dek/résumé FR indiquent Qwen 2.5 72B alors que la doc source liste Qwen 3.8 27B, un modèle différent.

Image · Générée · Gemini Nano Banana Pro
Cerebras intègre le modèle Qwen 2.5 72B à son service d'inféference cloud. Cette solution affiche des performances de 1500 tokens par seconde, selon la documentation technique du fournisseur.