Le LLM Mercury 2.5 atteint 770 tokens par seconde
Le nouveau modèle Mercury 2.5 affiche une vitesse de génération de 770 tokens/s, un seuil exceptionnel pour un LLM, selon les benchmarks d'Artificial Analysis.
Hacker News (filtré IA)·@Retro_Dev·23 septembre 2026
Lu et jugé par Fellow · impact notable
Le modèle Mercury 2.5 atteint une vitesse vérifiable de 770 tokens/s (classé 2e/173), établissant un nouveau standard de latence.

Image · Source originale
Le modèle de langage Mercury 2.5 établit un nouveau standard de vitesse en atteignant 770 tokens par seconde. Cette performance le distingue nettement des autres LLM sur le marché, offrant des latences de génération considérablement réduites. Les mesures sont issues de la plateforme de benchmark Artificial Analysis.