أطلقت Qwen الأوزان المفتوحة لنموذجها Qwen 3.8 27B. نقطة التفتيش متاحة على Hugging Face.
Qwen تطلق الأوزان المفتوحة لنموذج Qwen 3.8 27B
إصدار ISTA لنماذج GSQ-RCO GGUF الخاصة بـ Qwen3.8-Flash-Next وإصدار Coder المقتطع بنسبة 50% من الخبراء
أصدر مختبر خوارزميات ISTA العميق والأنظمة إصدارات GGUF المُكمّاة للنموذج ذو الخبراء المتناثرين Qwen3.8-Flash-Next، جنباً إلى جنب مع بناء تجريبي مستهدف القدرات تمت إزالة نصف خبراءه.
Quantization-Aware Healing يستعيد نماذج LLM ذات 4 بت أسرع من QAT
يقدم المؤلفون Quantization-Aware Healing (QAH)، وهو خط أنابيب يقوم بتقطيع طلاب 4 بت مباشرة من النماذج غير المضغوطة لاستعادة الأداء المفقود أثناء الضغط الهيكلي والتكميم. عند تطبيقه على GPT-OSS 120B، ينتج هذا الأسلوب Hypernova-60B، الذي يساوي أو يتفوق على المصدر bfloat16 في 7 من أصل 9 معايير مع استخدام حوالي 4 أضعاف أقل من ذاكرة الأوزان.
الشفاء الواعي للكمية يستعيد نماذج LLM ذات 4 بت أسرع من QAT
يقدم المؤلفون الشفاء الواعي للكمية (QAH)، وهي طريقة لاستعادة قدرات الاستدلال والبرمجة في نماذج اللغة الكبيرة المضغوطة هيكلياً بـ 4 بت. على عكس التدريب الواعي للكمية القياسي الذي يعيد ضبط النموذج المضغوط، يقوم QAH باستخلاص الطالب ذو الـ 4 بت مباشرة من النموذج الأصلي غير المضغوط.
PrismML تطلق Bonsai 27B، مضغوطة من Qwen3.6-27B بأوزان بت واحد وثلاثية القيم
أطلقت PrismML نموذج Bonsai 27B، وهو ضغط منخفض البت لنموذج Qwen3.6-27B يتيح تشغيل النماذج متعددة الوسائط الكبيرة على أجهزة الكمبيوتر المحمولة والهواتف دون إعادة تدريب.
Qwen3.5 122B A10B بـ UD-Q2_K_XL يتسع لـ 64 جيجابايت من ذاكرة الوصول العشوائي ويحسن المعرفة الداخلية
يُظهر مستخدم أن Qwen3.5 122B A12B المُكمَّم بـ UD-Q2_K_XL يمكن أن يتسع إلى 64 جيجابايت من ذاكرة النظام، مما يحل محل الخيار الأفضل السابق لهذا القيد.