يقدم تقرير Qwen2 التقني سلسلة Qwen2، وهي مجموعة جديدة من النماذج اللغوية الكبيرة والمتعددة الوسائط الأساسية والمضبوطة للتعليمات، تتراوح بين 0.5 و72 مليار معلمة. يتضمن هذا الإصدار كلًا من البنى الكثيفة ونموذج مزيج الخبراء (Mixture-of-Experts)، حيث يُظهر النموذج الرائد Qwen2-72B أداءً تنافسيًا مقابل النماذج الخاصة عبر معايير تقييم مختلفة.

  • يحقق النموذج الأساسي Qwen2-72B نتائج تبلغ 84.2 على MMLU، و37.9 على GPQA، و64.6 على HumanEval، و89.5 على GSM8K، و82.4 على BBH.
  • يصل نموذج Qwen2-72B-Instruct المضبوط للتعليمات إلى 9.1 على MT-Bench، و48.1 على Arena-Hard، و35.7 على LiveCodeBench.
  • تدعم النماذج حوالي 30 لغة، بما في ذلك الإنجليزية والصينية والإسبانية والفرنسية والألمانية والعربية والروسية والكورية واليابانية والتايلاندية والفيتنامية.
  • الأوزاء متاحة بشكل مفتوح على Hugging Face وModelScope، مع توفير الكود الإضافي وموارد النشر على GitHub.

أطلق المؤلفون هذه الأوزاء لتعزيز الابتكار المجتمعي وإتاحة الوصول، وتوفير موارد للضغط الدقيق (quantization)، والضبط الدقيق (fine-tuning)، والنشر لتسهيل مجموعة واسعة من التطبيقات وجهود البحث.