Alibaba выпустила веса модели Qwen3.8-Flash-Next, служащие превью будущей архитектуры Qwen4 для экспериментов и оценки разработчиками.
- Модель представляет собой мультимодальную mixture-of-experts (MoE) с 176B общих параметров, включая 51B параметров встраивания N-грамм.
- Она активирует 6B параметров на токен, сохраняя нативное контекстное окно длиной 262,144 токена.
- Контекстное окно расширяемо до 1M токенов с помощью YaRN.
Этот релиз позволяет разработчикам оценить возможности новой архитектуры для задач агентного программирования до официального запуска Qwen4.