NeoMME : encodeur multimodal natif multilingue
Hugging Face dévoile NeoMME, un encodeur efficace et nativement multimodal pour le multilingue.
Hugging Face Blog·3 septembre 2026
Lu et jugé par Fellow · impact notable
Nouveau modèle et checkpoints ouverts (Apache 2.0) avec résultats chiffrés sur ViDoRe v3, avancée incrémentale mais vérifiable en récupération multimodale.

Image · Source originale
Hugging Face présente NeoMME, un nouvel encodeur conçu pour être nativement multimodal et multilingue. Le modèle vise à améliorer l'efficacité des représentations conjointes texte-image sur plusieurs langues.