DeepSeek ने Hugging Face पर DeepSeek-V4-Flash-Vision-Exp मॉडल चेकपॉइंट प्रकाशित किया है। रिपॉजिटरी अब सार्वजनिक पहुंच के लिए उपलब्ध है।
DeepSeek ने Hugging Face पर DeepSeek-V4-Flash-Vision-Exp जारी किया
Thinking Machines ने Inkling जारी किया, Tencent ने Apache 2.0 लाइसेंस के साथ Hy3 को अपडेट किया
ओपन मॉडल आर्टिफैक्ट्स की ताज़ा समीक्षा में Thinking Machines और Tencent से महत्वपूर्ण रिलीज़ और Poolside तथा DeepSeek से अपडेट्स उभरकर सामने आए हैं।
थिंकिंग मशीन्स लैब ने ओपन-वेइट्स इंकलिंग फाउंडेशन मॉडल जारी किया
थिंकिंग मशीन्स लैब ने इंकलिंग को लॉन्च किया, जो इसका पहला पूरी तरह से जारी किया गया ओपन-वेइट्स फाउंडेशन मॉडल परिवार है। एक बेंचमार्क-अधिकतम फ्लैगशिप के बजाय, एक कस्टमाइज़ करने योग्य मल्टीमोडल बेस मॉडल के रूप में स्थित, इंकलिंग नेटिव मल्टीमोडलिटी के साथ टेक्स्ट, छवि और ऑडियो इनपुट का समर्थन करता है।
अलीबाबा की Qwen टीम ने Qwen3.8-Flash-Next जारी किया, जो Qwen4 का पूर्वावलोकन प्रस्तुत करता है
अलीबाबा की Qwen टीम ने Qwen3.8-Flash-Next जारी किया है, एक ओपन-वेट मल्टीमोडल मिक्स्चर-ऑफ-एक्सपर्ट्स मॉडल जो आगामी Qwen4 सीरीज़ के लिए आर्किटेक्चर का पूर्वावलोकन प्रस्तुत करने के लिए डिज़ाइन किया गया है। चेकपॉइंट में 125B बैकबोन, 51B N-ग्राम एम्बेडिंग टेबल और 4B मल्टी-टोकन प्रिडिक्शन मॉड्यूल शामिल हैं, जिसमें प्रति टोकन केवल 6B पैरामीटर सक्रिय होते हैं।
Zhipu AI ने GLM-5.3-Flash जारी किया, एक बहुमोडल ओपन-वेट मॉडल
Zhipu AI ने GLM-5.3-Flash जारी किया है, जो GLM-5 श्रृंखला में पहला नैटिवली बहुमोडल मॉडल और glm5_next आर्किटेक्चर का पहला ओपन-वेट रिलीज है। 320B-पैरामीटर वाला मॉडल एक 30T-टोकन बहुमोडल कॉरपस पर प्रशिक्षित किया गया है और लंबे संदर्भ की सेवा लागत को कम करने के लिए हाइब्रिड स्पार्स और रैखिक ध्यान तंत्र का उपयोग करता है।
ZhiPu ने 320B पैरामीटर वाला मल्टीमोडल मॉड GLM-5.3-Flash जारी किया
ZhiPu ने GLM-5.3-Flash पेश किया, जो GLM-5 श्रृंखला का पहला नैटिवली मल्टीमोडल मॉडल है, जिसमें एक हाइब्रिड आर्किटेक्चर है जो स्पार्स और लीनियर एटेंशन को जोड़ता है ताकि सटीकता बनाए रखते हुए लंबे संदर्भ सेवा लागत कम की जा सके।