xAI ने Grok-2 और इसके छोटे संस्करण, Grok-2 mini का एक प्रारंभिक पूर्वावलोकन जारी किया है, जो पिछले Grok-1.5 मॉडल से महत्वपूर्ण अपग्रेड को चिह्नित करता है। ये नए मॉडल वर्तमान में Premium और Premium+ उपयोगकर्ताओं के लिए 𝕏 पर बीटा में उपलब्ध हैं, जिसके लिए इसी महीन बाद एंटरप्राइज़ API पहुंच की योजना बनाई गई है।
- Grok-2 चैट, कोडिंग और तर्कशक्ति में अग्रणी क्षमताओं को प्रदर्शित करता है, जो LMSYS Chatbot Arena लीडरबोर्ड पर Claude 3.5 Sonnet और GPT-4-Turbo से बेहतर प्रदर्शन करता है।
- दोनों मॉडलों ने निर्देशों का पालन करने, तथ्यात्मक जानकारी प्रदान करने और टूल उपयोग में Grok-1.5 की तुलना में महत्वपूर्ण सुधार दिखाए हैं।
- बेंचमार्क दर्शाते हैं कि ग्रेजुएट-स्तर के विज्ञान (GPQA), सामान्य ज्ञान (MMLU, MMLU-Pro) और गणित (MATH) में अन्य अग्रणी मॉडलों के साथ प्रतिस्पर्धी प्रदर्शन है।
- Grok-2 दृश्य गणितीय तर्कशक्ति (MathVista) और दस्तावेज़-आधारित प्रश्नोत्तर (DocVQA) में सर्वश्रेष्ठ परिणाम प्राप्त करता है।
- एंटरप्राइज़ API बहु-क्षेत्र अनुमान विन्यास को अनिवार्य मल्टी-फैक्टर प्रमाणीकरण जैसे बढ़े हुए सुरक्षा सुविधाओं के साथ समर्थित करेगा।
रिलीज नए कंप्यूट क्लस्टर और विस्तृत बहुआयामी समझ के माध्यम से कोर तर्कशक्ति क्षमताओं को आगे बढ़ाकर xAI को AI विकास के अग्रस्थान पर स्थापित करती है।