Les VLM réduisent l'énergie IA et boostent la précision
Encoder les séries temporelles en images diminue drastiquement les tokens et la consommation énergétique.
arXiv cs.AI · cs.LG · cs.CL·Bhavika Jalli, Nikhil Korati Prasanna, Jayanta Choudhury·7 août 2026

Image · Source originale
Les Vision-Language Models (VLMs) encodent les données de séries temporelles en images 2D, réduisant les tokens d'entrée de 3,6 à 10,4 fois. Cette approche baisse la consommation énergétique de 1,8 à 2,5 fois et améliore la précision de détection d'anomalies par rapport aux LLM textuels.