L'équipe Qwen d'Alibaba a rendu Qwen3.8-Max largement disponible via API, avec des poids ouverts pour Qwen3.8-Max et le checkpoint plus petit Qwen3.8-27B prévus pour la semaine prochaine. Le modèle phare est une architecture mixture-of-experts de 2,4 billions de paramètres qui accepte des entrées textuelles, image et vidéo.

  • Qwen3.8-Max dispose d'une fenêtre de contexte de 1M tokens, avec une entrée maximale de 991K tokens et une sortie de 131K tokens.
  • La tarification est fixée à 2,00 $ par 1M tokens d'entrée, 6,00 $ par 1M tokens de sortie, et 0,25 $ pour les lectures d'entrées en cache.
  • Le modèle obtient un score de 86,6 sur Terminal-Bench 2.1 et mène PaperBench avec 93,0, montrant des gains significatifs dans les tâches multimodales et agentic par rapport à son prédécesseur.
  • Les capacités prises en charge incluent l'appel de fonctions, les sorties structurées et cinq outils intégrés tels que code_interpreter et web_search.

Cette publication offre une option multimodale très performante pour des secteurs comme le génie logiciel et la revue juridique, bien que le décompte total de 2,4T paramètres limite le déploiement sur site à la variante plus petite Qwen3.8-27B.