Toutes les news taguées avec ce sujet.
Le modèle Qwen 2.5 72B est désormais proposé sur l'inférence Cerebras, atteignant une vitesse de 1500 tokens par seconde.
Une analyse vidéo des performances des processeurs Cerebras face aux dominantes solutions graphiques de Nvidia.
Le fabricant de puces spécialisées annonce la prochaine génération de son système de calcul dédié à l'IA à grande échelle.
Cerebras annonce une collaboration avec OpenAI pour exécuter une variante rapide de GPT-5.6 sur son infrastructure spécialisée.
Le nouveau tier API Ultrafast propulse GPT-5.6 Sol à une vitesse 14 fois supérieure via l'infrastructure Cerebras.