Z.AI ने बुधवार को पुष्टि की कि Ox Alpha मॉडल उसकी GLM श्रृंखला का एक नया संस्करण है। कंपनी ने Bloomberg News के प्रश्नों के उत्तर देते हुए कहा कि वह उस रात बाद में मॉडल के वजन जारी करेगी।
Z.AI पुष्टि करता है कि Ox Alpha GLM श्रृंखला का एक नया मॉडल है और वजन जारी करेगा
Z.ai ने GLM-5.3 को विस्तारित पोस्ट-ट्रेनिंग के साथ जारी किया
Z.ai ने GLM-5.3 की घोषणा की, एक नया मॉडल जो अपने GLM-5.2 बेस मॉडल के पोस्ट-ट्रेनिंग को बढ़ाकर एजेंटिक कोडिंग बेंचमार्क्स पर फ्रंटियर प्रदर्शन हासिल करता है। ~750B पैरामीटर वाला मॉडल वर्तमान में Kimi K3 से आगे है और विभिन्न बेंचमार्क्स पर Claude Fable 5 और GPT-5.6-Sol के बराबर या उससे अधिक है।
बेंचमार्क, लाइसेंस और सर्विंग लागत पर Kimi K3, DeepSeek V4 Pro और GLM-5.2 की तुलना
तीन ओपन-वेट स्पर्स मिक्स्चर-ऑफ-एक्सपर्ट्स मॉडल्स—Moonshot AI का Kimi K3, DeepSeek V4 Pro, और Zhipu AI का GLM-5.2—की तुलना लंबे समय तक चलने वाले कोडिंग और एजेंट वर्कलोड के लिए उनकी क्षमताओं, लाइसेंस शर्तों और सर्विंग लागत के आधार पर की गई है।
Z.AI पुष्टि करता है कि Ox Alpha एक GLM मॉडल है और इसके वजन जारी करने की योजना बनाता है
Z.AI ने हाल ही में चर्चित "Ox Alpha" मॉडल के बारे में पुष्टि की है कि यह उनकी GLM परिवार का हिस्सा है। कंपनी ने मॉडल के वजन को सार्वजनिक रूप से जारी करने के अपने इरादे की भी घोषणा की है।
GLM-5.3 DeepSWE पर Claude Fable 5 की सटीकता को पांचवें खर्च पर बराबर लाता है
DeepSWE बेंचमार्क पर GLM-5.3 और Claude Fable 5 की तुलना से पता चलता है कि जबकि दोनों मॉडल्स लगभग समान पहली-शॉट सटीकता प्राप्त करते हैं (69.0% बनाम 69.7%), GLM-5.3 काफी अधिक लागत-प्रभावी है और बहु-प्रयास परिदृश्यों में बेहतर प्रदर्शन करता है।
GLM-5.3 और GPT-5.6 Sol का संवर्धन DeepSWE कार्यों के 85.9% को $6.61 में हल करता है
DeepSWE बेंचमार्क पर GLM-5.3 और GPT-5.6 Sol की तुलनात्मक विश्लेषण से पता चलता है कि एक संवर्धित रूटिंग रणनीति किसी भी मॉडल को अकेले उपयोग करने से बेहतर प्रदर्शन करती है। GLM-5.3 को पहले चलाने और केवल तब GPT-5.6 Sol पर स्केलेट करने के जब टेस्ट विफल होते हैं, सिस्टम प्रति कार्य $6.61 में 85.9% कार्यों को हल करता है।