Z.ai telah merilis GLM-5.3, sebuah pembaruan untuk modelnya yang memiliki 743B parameter, yang mencapai peningkatan kinerja melalui skala pasca-pelatihan alih-alih pelatihan ulang model dasar. Rilis ini saat ini tersedia melalui API Z.ai, Paket Coding GLM, dan ZCode, dengan bobot publik dijadwalkan dirilis sekitar dua minggu setelah peluncuran setelah evaluasi keamanan.

  • Skor Terminal-Bench 3.0 meningkat dari 4,6 menjadi 28,3, sementara DeepSWE v1.1 membaik dari 46,2 menjadi 66,9.
  • Hasil CyberGym mencapai 84,5%, melampaui Mythos 5 (83,8%) dan GPT-5.6 Sol (83,6%).
  • Skor ExploitBench lebih dari dua kali lipat menjadi 54,4%, meskipun masih di bawah skor Mythos 5 sebesar 78,0%.
  • Pada Z.ai Code Bench, model melaporkan peningkatan 50% dibandingkan GLM-5.2, dengan skor 31,4% pada sekitar 50.000 token keluaran per tugas.

Pembaruan ini diposisikan untuk alat pengembang, keamanan aplikasi, dan rekayasa fintech, dengan aplikasi spesifik termasuk refaktor skala repositori, agen CLI jangka panjang, dan penemuan kerentanan white-box.