A Z.ai lançou o GLM-5.3, uma atualização para seu modelo de 743B parâmetros que alcança ganhos de desempenho por meio de pós-treinamento escalado, em vez de retratamento do modelo base. O lançamento está atualmente disponível via API da Z.ai, Plano de Codificação GLM e ZCode, com pesos públicos programados para serem liberados aproximadamente duas semanas após o lançamento, após avaliações de segurança.
- As pontuações do Terminal-Bench 3.0 aumentaram de 4,6 para 28,3, enquanto o DeepSWE v1.1 melhorou de 46,2 para 66,9.
- Os resultados do CyberGym atingiram 84,5%, superando o Mythos 5 (83,8%) e o GPT-5.6 Sol (83,6%).
- As pontuações do ExploitBench mais que dobraram para 54,4%, embora permaneçam abaixo dos 78,0% do Mythos 5.
- No Z.ai Code Bench, o modelo relatou uma melhoria de 50% em relação ao GLM-5.2, com pontuação de 31,4% em aproximadamente 50.000 tokens de saída por tarefa.
A atualização é direcionada para ferramentas de desenvolvimento, segurança de aplicações e engenharia de fintech, com aplicações específicas incluindo refatorações em escala de repositório, agentes CLI de longo prazo e descoberta de vulnerabilidades white-box.