Z.ai ha lanzado formalmente GLM-5.3-Flash, revelando que el modelo previamente anticipado como "Ox Alpha" es su identidad pública. El modelo cuenta con 320 mil millones de parámetros totales y 18 mil millones activos, una ventana de contexto de 1 millón de tokens y capacidades multimodales nativas.
- Publicado bajo la Licencia MIT, está disponible mediante pesos en Hugging Face, API, chat y planes de codificación.
- Z.ai afirma que supera a GLM-5.2 en todos los niveles de esfuerzo y iguala a Claude Opus 4.8 en benchmarks de codificación.
- Artificial Analysis reporta un puntaje de Índice de Inteligencia de 57, empatando con GPT-5.6 Terra y Muse Spark 1.2 pero a un costo significativamente menor.
- La arquitectura utiliza atención híbrida estilo Kimi Linear, caminos residuales estilo DeepSeek V4 y se ejecuta completamente en chips de IA chinos.
- El soporte inicial de infraestructura apareció de CoreWeave y Baseten, con una corrección de plantilla de prompt emitida poco después del lanzamiento.
El lanzamiento posiciona a GLM-5.3-Flash como una opción altamente competitiva en precio para generación de código y tareas agénticas, aunque las evaluaciones independientes sugieren que puede ser menos preciso en conocimiento factual general en comparación con su rendimiento de razonamiento.