L'article confirme que le modèle connu sous le nom d'Ox Alpha est GLM-5.3-Flash.
- Multimodal (Vision)
- Fenêtre de contexte de 1M tokens
- DeepSWE ~63%
L'article confirme que le modèle connu sous le nom d'Ox Alpha est GLM-5.3-Flash.
| Benchmark | Modèle | Score |
|---|---|---|
| DeepSWE | GLM-5.3-Flash | 63% |
Zai a présenté GLM-5.3-Flash, le premier modèle nativement multimodal de la série GLM-5. Il dispose d'une architecture hybride combinant l'attention clairsemée et linéaire pour réduire les coûts de service des contextes longs tout en maintenant des capacités précises.
Zhipu AI a publié GLM-5.3-Flash, le premier modèle nativement multimodal de la série GLM-5 et la première version open-weight de l'architecture glm5_next. Le modèle à 320 milliards de paramètres est entraîné sur un corpus multimodal de 30 billions de tokens et intègre un mécanisme d'attention hybride combinant une attention linéaire et une attention creuse pour réduire les coûts de service sur des contextes longs.
ZhiPub présente GLM-5.3-Flash, le premier modèle nativement multimodal de la série GLM-5, doté d'une architecture hybride combinant l'attention sparse et linéaire pour réduire les coûts de service de contexte long tout en préservant la précision.
Z.ai a rendu l'API GLM-5.3 disponible avec des prix inchangés, offrant des capacités de codage et de performance d'agents à long terme supérieures par rapport à son prédécesseur. Parallèlement, Cerebras a présenté son nouvel ordinateur CS-4, qu'il affirme être plusieurs fois plus rapide que sa génération précédente et plus réactif que les systèmes basés sur Nvidia.
Mistral héberge désormais le modèle GLM-5.2, qui est même moins cher que son modèle phare actuel, Mistral Medium 3.5.
Nous utilisons des cookies pour mesurer l'audience et améliorer le site. Vous pouvez accepter ou refuser les cookies analytiques. Politique de confidentialité