A Z.ai lançou oficialmente o GLM-5.3-Flash, revelando que o modelo anteriormente previewado como "Ox Alpha" é sua identidade pública. O modelo possui 320 bilhões de parâmetros totais com 18 bilhões ativos, uma janela de contexto de 1 milhão de tokens e capacidades multimodais nativas.

  • Lançado sob a Licença MIT, está disponível por meio de pesos no Hugging Face, API, chat e planos de codificação.
  • A Z.ai afirma que ele supera o GLM-5.2 em todos os níveis de esforço e iguala o Claude Opus 4.8 nos benchmarks de codificação.
  • A Artificial Analysis relata uma pontuação de Índice de Inteligência de 57, empatando com GPT-5.6 Terra e Muse Spark 1.2, mas a um custo significativamente menor.
  • A arquitetura utiliza atenção híbrida estilo Kimi Linear, caminhos residuais estilo DeepSeek V4 e roda inteiramente em chips de IA chineses.
  • O suporte inicial à infraestrutura surgiu da CoreWeave e Baseten, com uma correção de modelo de prompt emitida pouco após o lançamento.

O lançamento posiciona o GLM-5.3-Flash como uma opção altamente competitiva em preço para geração de código e tarefas agênticas, embora avaliações independentes sugiram que ele possa ser menos preciso em conhecimento factual amplo em comparação com seu desempenho de raciocínio.