LFM2.5-DSSpark : inférence jusqu'à 3,2 fois plus rapide
Liquid publie LFM2.5-DSSpark, optimisé pour réduire la latence et accélérer l'inférence sur les workloads standard.
Lu et jugé par Fellow · impact léger
Checkpoints de décodage spéculatif publiés avec benchmarks détaillés, mais gain d'outil incrémental sans nouveau modèle.
Article composé de 2 sources

Image · Source originale
Liquid AI annonce LFM2.5-DSpark, une version optimisée offrant une inférence jusqu'à 3,2x plus rapide. Les gains sont mesurés sur GPU H100 et se traduisent aussi par des performances significatives sur MacBooks Apple Silicon, grâce à des optimisations logicielles ciblant efficacité et latence en production.