इस सप्ताह की AI खबरों में Z.ai, Tencent और Alibaba से महत्वपूर्ण ओपन-वेट मॉडल रिलीज़ के साथ-साथ इन्फरेंस इंफ्रास्ट्रक्चर और एजेंट बेंचमार्किंग में विकास पर प्रकाश पड़ता है।

  • Z.ai ने एजेंटिक कोडिंग और साइबर डिफेंस के लिए 744B कुल पैरामीटर वाले GLM-5.3 को जारी किया, जबकि इसका Flash वेरिएंट कम लागत पर उच्च गुणवत्ता प्रदान करता है।
  • Tencent ने Hy4-preview लॉन्च किया, जो एक 770B MoE मॉडल है और कोड जनरेशन कार्यों में Hy3 की तुलना में महत्वपूर्ण प्रदर्शन लाभ दिखाता है।
  • Alibaba ने Qwen3.8-Flash पेश किया, जो सस्ते, लंबे-संदर्भ बहुआयामी इन्फरेंस के लिए डिज़ाइन किया गया एक 125B MoE मॉडल है, हालांकि प्रारंभिक रिपोर्टों में FP8 क्वांटाइजेशन के साथ स्थिरता की समस्याओं का उल्लेख मिलता है।
  • vLLM ने स्पेकुलेटिव डिकोडिंग विधियों की तुलना करते हुए बेंचमार्क्स प्रकाशित किए, जिनमें कोई सार्वभौमिक विजेता नहीं मिला और कार्यभार-विशिष्ट ट्यूनिंग पर जोर दिया गया।
  • Alibaba Accio ने CommerceAgentBench को ओपन-सोर्स किया, जो एक 107-कार्य बेंचमार्क है जो केवल उत्तर की गुणवत्ता के बजाय वास्तविक कार्य पूर्णता को मापता है।
  • Google के शोध से पता चलता है कि स्थिर वीकी में संग्रहीत पोर्टेबल कौशल मॉडल परिवारों के बीच प्रभावी रूप से हस्तांतरित होते हैं, जो संभवतः फाइन-ट्यूनिंग की तुलना में अधिक मजबूत एजेंट क्षमताएं प्रदान करते हैं।