Toutes les news taguées avec ce sujet.
Le modèle Qwen 2.5 72B est désormais proposé sur l'inférence Cerebras, atteignant une vitesse de 1500 tokens par seconde.
Startup YC proposant des machines virtuelles persistantes pour calcul intensif gérées en ligne de commande.
Le fournisseur cloud allemand propose une plateforme expérimentale pour exécuter des modèles LLM.
Face à des coûts d'infrastructure élevés, de nombreuses entreprises révisent leurs stratégies d'adoption de l'IA générative.
Des documents révèlent que la majorité des revenus générés par l'IA chez Microsoft provient de son partenariat avec OpenAI.