El artículo confirma que el modelo conocido como Ox Alpha es GLM-5.3-Flash.
- Multimodal (Visión)
- Ventana de contexto de 1M tokens
- DeepSWE ~63%
El artículo confirma que el modelo conocido como Ox Alpha es GLM-5.3-Flash.
| Benchmark | Modelo | Puntuación |
|---|---|---|
| DeepSWE | GLM-5.3-Flash | 63% |
Zai ha presentado GLM-5.3-Flash, el primer modelo nativamente multimodal de la serie GLM-5. Cuenta con una arquitectura híbrida que combina atención dispersa y lineal para reducir los costos de servicio de contextos largos mientras mantiene capacidades precisas.
Zhipu AI ha lanzado GLM-5.3-Flash, el primer modelo nativamente multimodal de la serie GLM-5 y el primer lanzamiento de peso abierto de la arquitectura glm5_next. El modelo de 320B parámetros se entrena en un corpus multimodal de 30T tokens y presenta un mecanismo de atención híbrido disperso y lineal para reducir los costos de servicio de contexto largo.
ZhiPu presenta GLM-5.3-Flash, el primer modelo nativamente multimodal de la serie GLM-5, que cuenta con una arquitectura híbrida que combina atención dispersa y lineal para reducir los costos de servicio de contexto largo mientras preserva la precisión.
Z.ai ha puesto disponible la API GLM-5.3 con precios inalterados, ofreciendo un mejor rendimiento en codificación y agentes de horizonte largo en comparación con su predecesor. Simultáneamente, Cerebras presentó su nueva computadora CS-4, que afirma ser varias veces más rápida que su generación anterior y más receptiva que los sistemas basados en Nvidia.
Mistral ahora está alojando el modelo GLM-5.2, que tiene un precio aún más bajo que su modelo insignia actual, Mistral Medium 3.5.
Usamos cookies para medir el tráfico y mejorar el sitio. Puedes aceptar o rechazar las cookies de analítica. Política de privacidad