v0.29.0rc2 रिलीज़ में, SHM वर्कर कैश के लिए एक बगफ़िक्स शामिल है ताकि प्रीफ़िक्स-कवर्ड आइटम्स को उचित रूप से संभाला जा सके।
- SHM वर्कर कैश में प्रीफ़िक्स-कवर्ड आइटम्स के उचित रूप से न संभाले जाने की समस्या को हल करता है।
v0.29.0rc2 रिलीज़ में, SHM वर्कर कैश के लिए एक बगफ़िक्स शामिल है ताकि प्रीफ़िक्स-कवर्ड आइटम्स को उचित रूप से संभाला जा सके।
DeepSeek ने Hugging Face पर DeepSeek-V4-Flash-Vision-Exp मॉडल चेकपॉइंट प्रकाशित किया है। रिपॉजिटरी अब सार्वजनिक पहुंच के लिए उपलब्ध है।
अलीबाबा की Qwen टीम ने Qwen3.8-Flash-Next जारी किया है, एक ओपन-वेट मल्टीमोडल मिक्स्चर-ऑफ-एक्सपर्ट्स मॉडल जो आगामी Qwen4 सीरीज़ के लिए आर्किटेक्चर का पूर्वावलोकन प्रस्तुत करने के लिए डिज़ाइन किया गया है। चेकपॉइंट में 125B बैकबोन, 51B N-ग्राम एम्बेडिंग टेबल और 4B मल्टी-टोकन प्रिडिक्शन मॉड्यूल शामिल हैं, जिसमें प्रति टोकन केवल 6B पैरामीटर सक्रिय होते हैं।
Zhipu AI ने GLM-5.3-Flash जारी किया है, जो GLM-5 श्रृंखला में पहला नैटिवली बहुमोडल मॉडल और glm5_next आर्किटेक्चर का पहला ओपन-वेट रिलीज है। 320B-पैरामीटर वाला मॉडल एक 30T-टोकन बहुमोडल कॉरपस पर प्रशिक्षित किया गया है और लंबे संदर्भ की सेवा लागत को कम करने के लिए हाइब्रिड स्पार्स और रैखिक ध्यान तंत्र का उपयोग करता है।
Zai ने GLM-5.3-Flash का परिचय दिया, जो GLM-5 श्रृंखला में पहला नैटिवली मल्टीमोडल मॉडल है। इसमें लंबे संदर्भ सेवा लागत को कम करने के लिए स्पार्स और लाइनर एटेंशन को जोड़ने वाला हाइब्रिड आर्किटेक्चर है, जबकि सटीक क्षमताओं को बनाए रखता है।
ZhiPu ने GLM-5.3-Flash पेश किया, जो GLM-5 श्रृंखला का पहला नैटिवली मल्टीमोडल मॉडल है, जिसमें एक हाइब्रिड आर्किटेक्चर है जो स्पार्स और लीनियर एटेंशन को जोड़ता है ताकि सटीकता बनाए रखते हुए लंबे संदर्भ सेवा लागत कम की जा सके।
हम ट्रैफ़िक मापने और साइट को बेहतर बनाने के लिए कुकीज़ का उपयोग करते हैं। आप एनालिटिक्स कुकीज़ स्वीकार या अस्वीकार कर सकते हैं। गोपनीयता नीति