Z.ai 发布了 GLM-5.3,这是对其 743B 参数模型的更新,该模型通过扩展后训练而非基础模型重新训练来实现性能提升。目前可通过 Z.ai API、GLM Coding Plan 和 ZCode 获取该版本,公共权重将在发布后约两周经过安全评估后推出。
- Terminal-Bench 3.0 得分从 4.6 提升至 28.3,DeepSWE v1.1 从 46.2 提升至 66.9。
- CyberGym 结果达到 84.5%,超越 Mythos 5 (83.8%) 和 GPT-5.6 Sol (83.6%)。
- ExploitBench 得分翻倍以上至 54.4%,但仍低于 Mythos 5 的 78.0%。
- 在 Z.ai Code Bench 上,该模型相比 GLM-5.2 报告了 50% 的提升,每任务输出约 50,000 个 token 时得分为 31.4%。
此次更新面向开发者工具、应用安全和金融科技工程,具体应用场景包括仓库级重构、长周期 CLI 代理和白盒漏洞发现。