L'équipe Qwen d'Alibaba a annoncé Qwen 3.8 Max, un nouveau modèle phare de 2,4T de paramètres axé sur le codage, les travaux agents à long terme et le raisonnement multimodal. L'entreprise a confirmé que des versions à poids ouverts de Qwen 3.8 Max et du plus petit Qwen 3.8-27B seront publiées la semaine prochaine.
- Le modèle dispose d'une fenêtre de contexte de 1M de tokens, de 95B de paramètres actifs par token (environ 4 % de taux d'activation) et d'un retour visuel natif dans sa boucle d'exécution.
- Alibaba revendique des capacités incluant plus de 10 jours de codage autonome, plus de 500 itérations d'optimisation de conception de puces et 365 jours d'exécution de stratégie e-commerce.
- Des évaluations indépendantes placent Qwen 3.8 Max à la 4e place globale dans Frontend Code Arena avec 1 668 Elo et à la 2e place dans Vision Arena avec 1 305 points.
- Sur l'indice Vals, il se classe à la 2e place parmi les modèles à poids ouverts avec un score de 66,1, égalant Claude Opus 4.7 à un coût par test inférieur (2,68 $ contre 6,17 $).
- Les tarifs de l'API sont fixés à 2,00 $ par million de tokens d'entrée et 6,00 $ par million de tokens de sortie.
L'annonce signale que la frontière des modèles ouverts chinois concurrence désormais directement les meilleurs modèles fermés occidentaux, en particulier dans le codage et les flux de travail agents.