O artigo confirma que o modelo conhecido como Ox Alpha é o GLM-5.3-Flash.
- Multimodal (Visão)
- Janela de contexto de 1M tokens
- DeepSWE ~63%
O artigo confirma que o modelo conhecido como Ox Alpha é o GLM-5.3-Flash.
| Benchmark | Modelo | Pontuação |
|---|---|---|
| DeepSWE | GLM-5.3-Flash | 63% |
A Zai apresentou o GLM-5.3-Flash, o primeiro modelo nativamente multimodal da série GLM-5. Ele possui uma arquitetura híbrida que combina atenção esparsa e linear para reduzir os custos de serviço de contextos longos enquanto mantém capacidades precisas.
A Zhipu AI lançou o GLM-5.3-Flash, o primeiro modelo nativamente multimodal da série GLM-5 e o primeiro lançamento de pesos abertos da arquitetura glm5_next. O modelo com 320B parâmetros é treinado em um corpus multimodal de 30T tokens e apresenta um mecanismo de atenção híbrido esparso e linear para reduzir os custos de serviço de contexto longo.
A ZhiPu apresenta o GLM-5.3-Flash, o primeiro modelo nativamente multimodal da série GLM-5, que possui uma arquitetura híbrida combinando atenção esparsa e linear para reduzir os custos de serviço de contexto longo enquanto preserva a precisão.
A Z.ai disponibilizou a API GLM-5.3 com preços inalterados, oferecendo desempenho superior de codificação e de agentes de longo prazo em comparação com sua versão anterior. Simultaneamente, a Cerebras apresentou seu novo computador CS-4, que afirma ser várias vezes mais rápido que sua geração anterior e mais responsivo do que os sistemas baseados em Nvidia.
A Mistral agora está hospedando o modelo GLM-5.2, que tem um preço ainda mais baixo do que seu modelo principal atual, o Mistral Medium 3.5.
Usamos cookies para medir o tráfego e melhorar o site. Você pode aceitar ou recusar os cookies de análise. Política de privacidade