أطلقت علي بابا كلاود النسخة مفتوحة المصدر من سلسلة Qwen2.5 من نماذج اللغة الكثيفة ذات المفسر فقط، بإضافة ثلاثة أحجام جديدة (3B و14B و32B) إلى التشكيلة الحالية التي تتراوح بين 0.5B و72B معلمة. يوسع هذا التحديث مجموعة بيانات التدريب المسبق من 7 تريليون إلى 18 تريليون رمز ويضم اختراقات تقنية من Qwen2.5-Coder وQwen-math لتحسين الأداء بشكل كبير في البرمجة والرياضيات والمعرفة العامة.

  • يتفوق نموذج Qwen2.5-32B على Qwen2-72B، بينما يتجاوز Qwen2.5-14B نموذج Qwen2-57B-A14B في التقييمات الشاملة.
  • تتجلى تعزيز المعرفة في معايير MMLU، حيث ارتفعت درجات Qwen2.5-7B/72B من 70.3 إلى 74.2 ومن 84.2 إلى 86.1 على التوالي.
  • تحسنت قدرات البرمجة بشكل كبير، حيث حقق Qwen2.5-72B-Instruct درجة 55.5 على LiveCodeBench و88.2 على MBPP.
  • زادت القدرة الرياضية بشكل ملحوظ، مما رفع درجات معيار MATH لنماذج Qwen2.5-7B/72B-Instruct من 52.9/69.0 إلى 75.5/83.1.
  • تحسّن محاذاة التفضيل البشري، حيث قفزت درجات Arena-Hard لـ Qwen2.5-72B-Instruct من 48.1 إلى 81.2.
  • يمتد دعم طول السياق إلى 128K رمز، وتُرخّص معظم النماذج بموجب رخصة Apache 2.0.

تستجيب هذه الإصدارية لطلب المستخدمين عن نماذج إنتاج فعالة من حيث التكلفة في نطاق 10-30B ونماذج محسّنة للهواتف المحمولة بحجم 3B، مما يوفر بدائل مفتوحة المصدر تنافسية للغاية تتطابق أو تتفوق على الأنظمة المغلقة الأكبر حجماً.