Z.AI는 수요일에 Ox Alpha 모델이 자체 GLM 시리즈의 새로운 버전임을 확인했습니다. 회사는 Bloomberg News의 문의에 응답하여 그 밤 늦게 모델의 가중치를 출시할 것이라고 밝혔습니다.
Z.AI, Ox Alpha가 GLM 시리즈의 새로운 모델임을 확인하고 가중치 공개 예정
Z.ai, 확장된 사후 학습이 적용된 GLM-5.3 출시
Z.ai는 베이스 모델인 GLM-5.2의 사후 학습을 확장하여 에이전트 코딩 벤치마크에서 최첨단 성능을 달성한 새로운 모델 GLM-5.3을 발표했습니다. 약 750B 파라미터를 가진 이 모델은 현재 Kimi K3을 능가하며 다양한 벤치마크에서 Claude Fable 5 및 GPT-5.6-Sol과 동등하거나 이를 초과하는 성능을 보입니다.
Kimi K3, DeepSeek V4 Pro, GLM-5.2 벤치마크, 라이선스, 서빙 비용 비교
세 가지 오픈 가중치 희소 Mixture-of-Experts 모델인 Moonshot AI의 Kimi K3, DeepSeek V4 Pro, Zhipu AI의 GLM-5.2를 비교하여 장기적 코딩 및 에이전트 워크로드에 대한 능력, 라이선스 조건, 서빙 비용을 평가합니다.
Z.AI, Ox Alpha가 GLM 모델임을 확인하고 가중치 공개 계획 발표
Z.AI는 최근 논의된 "Ox Alpha" 모델이 자신의 GLM 계열의 일부임을 확인했습니다. 회사는 또한 모델의 가중치를 공개적으로 출시할 의사를 발표했습니다.
GLM-5.3은 DeepSWE에서 Claude Fable 5의 정확도를 비용의 5분의 1로 달성
DeepSWE 벤치마크에서의 GLM-5.3과 Claude Fable 5 비교 분석 결과, 두 모델 모두 첫 시도 정확도(69.0% 대 69.7%)에서 거의 동일한 성능을 보였으나, GLM-5.3은 비용 효율성이 현저히 높고 다중 시도 시나리오에서도 더 우수한 성능을 보였다.
GLM-5.3와 GPT-5.6의 솔 캐스케이드가 DeepSWE 작업의 85.9%를 $6.61에 해결
DeepSWE 벤치마크에서 GLM-5.3과 GPT-5.6 Sol을 비교 분석한 결과, 캐스케이딩 라우팅 전략이 단일 모델만 사용하는 것보다 더 뛰어난 성능을 보였습니다. GLM-5.3을 먼저 실행하고 테스트가 실패할 때만 GPT-5.6 Sol로 승격시키는 방식으로 시스템을 운영하면, 작업당 $6.61의 비용으로 85.9%의 작업을 해결할 수 있습니다.