Alibaba a publié les poids du modèle Qwen3.8-Flash-Next, servant de prévisualisation de l'architecture Qwen4 à venir pour que les développeurs puissent expérimenter et évaluer.

  • Le modèle est une mixture-of-experts (MoE) multimodale avec 176B de paramètres totaux, incluant 51B de paramètres d'intégration N-gram.
  • Il active 6B de paramètres par token tout en maintenant une fenêtre de contexte native de 262,144 tokens.
  • La fenêtre de contexte est extensible à 1M de tokens en utilisant YaRN.

Cette publication permet aux développeurs d'évaluer les capacités de la nouvelle architecture pour les tâches de codage agentique avant le lancement officiel de Qwen4.