أطلقت NVIDIA نموذج Qwen3.6-27B-NVFP4 على Hugging Face.
الوزن المدقق متاح الآن للتنزيل.
أطلقت NVIDIA نموذج Qwen3.6-27B-NVFP4 على Hugging Face.
الوزن المدقق متاح الآن للتنزيل.
يقدم المؤلفون Quantization-Aware Healing (QAH)، وهو خط أنابيب يقوم بتقطيع طلاب 4 بت مباشرة من النماذج غير المضغوطة لاستعادة الأداء المفقود أثناء الضغط الهيكلي والتكميم. عند تطبيقه على GPT-OSS 120B، ينتج هذا الأسلوب Hypernova-60B، الذي يساوي أو يتفوق على المصدر bfloat16 في 7 من أصل 9 معايير مع استخدام حوالي 4 أضعاف أقل من ذاكرة الأوزان.
يقدم المؤلفون الشفاء الواعي للكمية (QAH)، وهي طريقة لاستعادة قدرات الاستدلال والبرمجة في نماذج اللغة الكبيرة المضغوطة هيكلياً بـ 4 بت. على عكس التدريب الواعي للكمية القياسي الذي يعيد ضبط النموذج المضغوط، يقوم QAH باستخلاص الطالب ذو الـ 4 بت مباشرة من النموذج الأصلي غير المضغوط.
أظهرت إنفيديا تقديم نموذج المعلمات Qwen 3.8 2.4T مع قدرات استدلال قابلة للتكوين على منصة الأجهزة الخاصة بها GB300 NVL72.
أطلقت Qwen الأوزان المفتوحة لنموذجها Qwen 3.8 27B. نقطة التفتيش متاحة على Hugging Face.
أطلقت أليبابا الأوزان المفتوحة لنموذج Qwen3.8-2.4T-A95B (المعروف أيضاً باسم Qwen3.8-Max)، وهو أكبر نموذج لها بأوزان مفتوحة، ومصمم لجلب قدرات قريبة من الحدود العليا إلى النظام البيئي المفتوح.
نستخدم ملفات تعريف الارتباط لقياس الزيارات وتحسين الموقع. يمكنك قبول أو رفض ملفات تعريف الارتباط الخاصة بالتحليلات. سياسة الخصوصية