أصدرت علي بابا التقرير الفني الخاص بـ Qwen2.5، مقدّمةً سلسلة شاملة من نماذج اللغة الكبيرة مع تحسينات كبيرة في كل من مرحلتي التدريب المسبق والتدريب اللاحق. يمتد التحديث مجموعات بيانات التدريب المسبق عالية الجودة من 7 تريليون إلى 18 تريليون رمز، وينفّذ ضبطًا دقيقًا للإشراف المعقّد بأكثر من مليون عيّنة جنبًا إلى جنب مع التعلم المعزز متعدد المراحل.

  • تشمل العروض ذات الأوزان المفتوحة النماذج الأساسية والنماذج المُضبوطة للتعليمات، مع توفر إصدارات مُكمَّمة.
  • تميّز الحلول المستضافة الخاصة بنوعين من مزيج الخبراء: Qwen2.5-Turbo و Qwen2.5-Plus.
  • يتفوق النموذج الرائد Qwen2.5-72B-Instruct على العديد من النماذج المفتوحة والمغلقة، ويُظهر أداءً تنافسيًا مقارنة بـ Llama-3-405B-Instruct.
  • تقدّم Qwen2.5-Turbo و Qwen2.5-Plus فعاليةً أعلى من حيث التكلفة مع أداءٍ تنافسيٍّ أمام GPT-4o-mini و GPT-4o على التوالي.

توفّر هذه التحسينات أساسًا متينًا للحدس العام، والمعرفة المتخصصة، وقدرات الاستدلال، بينما تحسّن تقنيات التدريب اللاحق بشكل ملحوظ توليد النصوص الطويلة، وتحليل البيانات الهيكلية، واتباع التعليمات.