Qwen3.8-Flash-Next 176B testé sur NVIDIA GB300 NVL72 pour le coding agentique
Alibaba dévoile les poids de Qwen3.8-Flash-Next, un aperçu de l'architecture Qwen4, expérimenté par NVIDIA sur ses puces GB300 NVL72.
NVIDIA Developer Blog·Michelle Horton·26 août 2026·+ 1 source Lu et jugé par Fellow · impact notable
Nouveaux poids Qwen ouverts avec architecture hybride GDN/QSA et gains mesurés (throughput, prefill) sur infrastructure NVIDIA validée.
Article composé de 2 sources

Image · Source originale
Alibaba a publié les poids de Qwen3.8-Flash-Next, un modèle multimodal MoE de 176 milliards de paramètres (51B dédiés aux embeddings N-gram, 6B activés par token), présenté comme un avant-goût de la future architecture Qwen4. Il dispose d'une fenêtre de contexte native de 262 144 tokens, extensible à 1M via YaRN. NVIDIA a testé ce modèle sur son infrastructure GB300 NVL72 pour des cas d'usage de coding agentique.