Qwen ने अपने Qwen 3.8 27B मॉडल के लिए ओपन वेट्स जारी किए हैं। चेकपॉइंट Hugging Face पर उपलब्ध है।
Qwen ने Qwen 3.8 27B के लिए ओपन वेट्स जारी किए
PrismML ने Bonsai 27B जारी किया, Qwen3.6-27B को 1-बिट और टर्नरी वजन में संपीड़ित किया
PrismML ने Bonsai 27B जारी किया है, जो Qwen3.6-27B मॉडल का एक लो-बिट क्वांटाइजेशन है जो बिना पुनः प्रशिक्षण के लैपटॉप और फोन पर बड़े बहुआयामी मॉडल चलाने की सुविधा देता है।
UD-Q2_K_XL में Qwen3.5 122B A10B, 64GB RAM में फिट होता है और आंतरिक ज्ञान में सुधार करता है
एक उपयोगकर्ता प्रदर्शित करता है कि UD-Q2_K_XL के साथ क्वांटाइज़ किया गया Qwen3.5 122B A10B, 64GB सिस्टम RAM में फिट हो सकता है, जिससे उस प्रतिबंध के लिए पिछला सर्वोत्तम विकल्प बदल जाता है।
दो RTX 3090 पर टर्नरी Qwen3.6 27B 60 tok/s पर चल रहा है
एक उपयोगकर्ता ने दो NVIDIA RTX 3090 GPUs पर टर्नरी-क्वांटाइज्ड Qwen3.6 27B मॉडल को सफलतापूर्वक चलाया होने की रिपोर्ट की। सेटअप स्थिर टूल कॉलिंग क्षमताओं के साथ प्रति सेकंड 60 टोकन की थ्रूपुट प्राप्त करता है।
PrismML ने iPhone के लिए Qwen3.6-27B को <4GB तक संपीड़ित किया
PrismML ने Alibaba के ओपन-सोर्स Qwen 3.6 मॉडल का एक संपीड़ित संस्करण विकसित किया है, जिससे 27 अरब पैरामीटर वाले बड़े भाषा मॉडल को iPhone 17 Pro पर चलाने की अनुमति मिलती है। स्टार्टअप ने Caltech के शोध से व्युत्पन्न एक गणितीय तकनीक का उपयोग करके मॉडल के आकार को लगभग 54 गिगाबाइट से कम करके 4 गिगाबाइट से भी कम कर दिया है।
NVIDIA ने Qwen3.6-27B-NVFP4 मॉडल जारी किया
NVIDIA ने Hugging Face पर Qwen3.6-27B-NVFP4 मॉडल जारी किया है।