أطلقت فريق Qwen نموذج Qwen3.8-Flash-Next، وهو متاح الآن على ModelScope.
يُقدم هذا الإصدار متغيرًا جديدًا في سلسلة Qwen3.8-Flash.
أطلقت فريق Qwen نموذج Qwen3.8-Flash-Next، وهو متاح الآن على ModelScope.
يُقدم هذا الإصدار متغيرًا جديدًا في سلسلة Qwen3.8-Flash.
أطلقت مجموعة Ant مفتوح المصدر لنموذج Ling-3.0-flash-Fin، وهو أول نموذج في عائلة Ant Ling محسّن للتمويل، تم تطويره بالتعاون مع مؤسسات مالية رائدة وخبراء في المجال.
أطلقت علي بابا نسخة مطورة من نموذجها اللغوي الكبير، Qwen3.8-Max-0902. يتميز النموذج الجديد بـ 2.4 تريليون معلمة ويدعم نافذة سياق تتكون من مليون رمز.
تسلط أخبار هذا الأسبوع في مجال الذكاء الاصطناعي الضوء على إصدارات نماذج ذات أوزان مفتوحة من Z.ai وTencent وAlibaba، جنبًا إلى جنب مع تطورات في بنية الاستدلال وتقييم الوكلاء.
أطلق فريق Qwen التابع لشركة علي بابا نموذج Qwen3.8-Flash-Next، وهو نموذج متعدد الوسائط مفتوح الأوزان من نوع Mixture-of-Experts مصمم لعرض الطراز المعماري لسلسلة Qwen4 القادمة. يجمع هذا الملف المحفوظ بين هيكل أساسي بحجم 125B وجدول تضمين N-gram بحجم 51B ووحدات تنبؤ متعددة الرموز بحجم 4B، مع تفعيل 6B معلمة فقط لكل رمز.
يقدم المؤلفون Quantization-Aware Healing (QAH)، وهو خط أنابيب يقوم بتقطيع طلاب 4 بت مباشرة من النماذج غير المضغوطة لاستعادة الأداء المفقود أثناء الضغط الهيكلي والتكميم. عند تطبيقه على GPT-OSS 120B، ينتج هذا الأسلوب Hypernova-60B، الذي يساوي أو يتفوق على المصدر bfloat16 في 7 من أصل 9 معايير مع استخدام حوالي 4 أضعاف أقل من ذاكرة الأوزان.
نستخدم ملفات تعريف الارتباط لقياس الزيارات وتحسين الموقع. يمكنك قبول أو رفض ملفات تعريف الارتباط الخاصة بالتحليلات. سياسة الخصوصية