लेख में पुष्टि की गई है कि Ox Alpha के रूप में जाने जाने वाला मॉडल GLM-5.3-Flash है।
- बहुआयामी (दृष्टि)
- 1M टोकन संदर्भ विंडो
- DeepSWE ~63%
लेख में पुष्टि की गई है कि Ox Alpha के रूप में जाने जाने वाला मॉडल GLM-5.3-Flash है।
| Benchmark | मॉडल | स्कोर |
|---|---|---|
| DeepSWE | GLM-5.3-Flash | 63% |
Zai ने GLM-5.3-Flash का परिचय दिया, जो GLM-5 श्रृंखला में पहला नैटिवली मल्टीमोडल मॉडल है। इसमें लंबे संदर्भ सेवा लागत को कम करने के लिए स्पार्स और लाइनर एटेंशन को जोड़ने वाला हाइब्रिड आर्किटेक्चर है, जबकि सटीक क्षमताओं को बनाए रखता है।
Zhipu AI ने GLM-5.3-Flash जारी किया है, जो GLM-5 श्रृंखला में पहला नैटिवली बहुमोडल मॉडल और glm5_next आर्किटेक्चर का पहला ओपन-वेट रिलीज है। 320B-पैरामीटर वाला मॉडल एक 30T-टोकन बहुमोडल कॉरपस पर प्रशिक्षित किया गया है और लंबे संदर्भ की सेवा लागत को कम करने के लिए हाइब्रिड स्पार्स और रैखिक ध्यान तंत्र का उपयोग करता है।
ZhiPu ने GLM-5.3-Flash पेश किया, जो GLM-5 श्रृंखला का पहला नैटिवली मल्टीमोडल मॉडल है, जिसमें एक हाइब्रिड आर्किटेक्चर है जो स्पार्स और लीनियर एटेंशन को जोड़ता है ताकि सटीकता बनाए रखते हुए लंबे संदर्भ सेवा लागत कम की जा सके।
Z.ai ने GLM-5.3 API को उपलब्ध कराया है, जिसमें मूल्य नहीं बदला गया है, और इसके पूर्ववर्ती की तुलना में बेहतर कोडिंग और लंबे समय तक चलने वाले एजेंट प्रदर्शन का प्रस्ताव दिया है। इसी बीच, Cerebras ने अपना नया CS-4 कंप्यूटर पेश किया, जिसका दावा है कि यह अपने पिछले पीढ़ी से कई गुना तेज़ है और Nvidia-आधारित सिस्टम की तुलना में अधिक प्रतिक्रियाशील है।
Mistral अब GLM-5.2 मॉडल को होस्ट कर रहा है, जिसकी कीमत उसके वर्तमान फ्लैगशिप मॉडल Mistral Medium 3.5 से भी सस्ती है।
हम ट्रैफ़िक मापने और साइट को बेहतर बनाने के लिए कुकीज़ का उपयोग करते हैं। आप एनालिटिक्स कुकीज़ स्वीकार या अस्वीकार कर सकते हैं। गोपनीयता नीति