Modèle multimodal open-weights de 12 milliards de paramètres, sans encodeur visuel séparé pour texte, image et vidéo.
Prix API en $ par million de tokens · source : recherche web · mis à jour le 18 juil. 2026 · fiche mise à jour le 18 juil. 2026
Google DeepMind lance Gemma 4 12B, un modèle open-weights multimodal qui abandonne l'architecture encodeur séparé au profit d'une approche unifiée.
Google publie Gemma 4 12B, un modèle open-weights multimodal qui traite texte, image et vidéo sans encodeur visuel séparé.