A Alibaba lançou os pesos do modelo Qwen3.8-Flash-Next, servindo como uma prévia da próxima arquitetura Qwen4 para que desenvolvedores possam experimentar e avaliar.

  • O modelo é uma mistura de especialistas multimodal (MoE) com 176B de parámetros totais, incluindo 51B de parámetros de incorporação N-gram.
  • Ele ativa 6B de parámetros por token enquanto mantém uma janela de contexto nativa de 262,144 tokens.
  • A janela de contexto é extensível a 1M de tokens usando YaRN.

Este lançamento permite que desenvolvedores avaliem as capacidades da nova arquitetura para tarefas de codificação agêntica antes do lançamento oficial do Qwen4.