أطلقت xAI نسخة تجريبية مبكرة من Grok-2 ومتغيرته الأصغر، Grok-2 mini، مما يمثل ترقية كبيرة مقارنةً بنموذج Grok-1.5 السابق. هذه النماذج الجديدة متاحة حالياً في النسخة التجريبية على 𝕏 لمستخدمي Premium وPremium+، مع خطط للوصول إلى واجهة برمجة التطبيقات (API) المؤسسية لاحقاً هذا الشهر.
- يُظهر Grok-2 قدرات رائدة في الدردشة والبرمجة والاستدلال، متفوقاً على Claude 3.5 Sonnet وGPT-4-Turbo في لوحة المتصدرين لـ LMSYS Chatbot Arena.
- يُظهر كلا النموذجين تحسناً كبيراً مقارنةً بـ Grok-1.5 في اتباع التعليمات، وتقديم المعلومات الواقعية، واستخدام الأدوات.
- تشير النتائج إلى أداء تنافسي مع نماذج رائدة أخرى في العلوم على مستوى الدراسات العليا (GPQA)، والمعرفة العامة (MMLU, MMLU-Pro)، والرياضيات (MATH).
- يحقق Grok-2 نتائج متقدمة في الاستدلال الرياضي البصري (MathVista) والإجابة على الأسئلة المستندة إلى الوثائق (DocVQA).
- ستدعم واجهة برمجة التطبيقات المؤسسية نشرات الاستدلال متعددة المناطق مع ميزات أمنية محسنة مثل المصادقة الثنائية الإلزامية.
تضع هذه الإصدار xAI في طليعة تطوير الذكاء الاصطناعي من خلال تعزيز قدرات الاستدلال الأساسية عبر مجموعة حوسبة جديدة وفهم متعدد الوسائط موسع.