Alibaba выпустила веса модели Qwen3.8-Flash-Next, служащие превью будущей архитектуры Qwen4 для экспериментов и оценки разработчиками.

  • Модель представляет собой мультимодальную mixture-of-experts (MoE) с 176B общих параметров, включая 51B параметров встраивания N-грамм.
  • Она активирует 6B параметров на токен, сохраняя нативное контекстное окно длиной 262,144 токена.
  • Контекстное окно расширяемо до 1M токенов с помощью YaRN.

Этот релиз позволяет разработчикам оценить возможности новой архитектуры для задач агентного программирования до официального запуска Qwen4.