Toutes les news taguées avec ce sujet.
Une étude contrôlée évalue 13 modèles Qwen et GPT pour déterminer l'influence de la taille sur l'apprentissage d'ontologies.
Alibaba dévoile les poids de Qwen3.8-Flash-Next, un aperçu de l'architecture Qwen4, expérimenté par NVIDIA sur ses puces GB300 NVL72.
Alibaba s'apprêterait à lancer un nouveau modèle MoE léger de la famille Qwen, avec seulement 6 milliards de paramètres actifs.
Alibaba ouvre les poids de son plus grand modèle, un MoE à 2,4T de paramètres avec raisonnement configurable, servi sur l'infrastructure NVIDIA.
NVIDIA dévoile Nemotron 3.5 Lightning, un modèle open-weights optimisé pour l'exécution rapide des tâches des agents IA.