أصدر فريق Qwen التقرير التقني الخاص بـ Qwen2، مقدمًا سلسلة جديدة من نماذج اللغة الكبيرة تتراوح بين 0.5 إلى 72 مليار معلمة، بما في ذلك كل من البنى الكثيفة (Dense) و Mixture-of-Experts (MoE).
- حقق النموذج الأساسي الرائد Qwen2-72B نتائج بـ 84.2 على MMLU، و 89.5 على GSM8K، و 64.6 على HumanEval.
- وصلت النسخة المُعدّلة بالتعليمات Qwen2-72B-Instruct إلى 9.1 على MT-Bench و 35.7 على LiveCodeBench.
- تم تدريب النماذج على أكثر من 7 تريليون توكن وتدعم حوالي 30 لغة.
- الأوزان متاحة بشكل مفتوح على Hugging Face و ModelScope للاستخدام المجتمعي.
يهدف هذا الإصدار إلى توفير نماذج أساسية عالية الأداء تتنافس مع الأنظمة المملوكة، مع الحفاظ على إمكانية الوصول إليها للأبحاث والنشر.