xAI telah merilis pratinjau awal dari Grok-2 dan varian lebih kecil, Grok-2 mini, menandai peningkatan signifikan dari model Grok-1.5 sebelumnya. Model-model baru ini saat ini tersedia dalam versi beta di 𝕏 untuk pengguna Premium dan Premium+, dengan akses API perusahaan yang direncanakan pada akhir bulan ini.
- Grok-2 menunjukkan kemampuan terdepan dalam obrolan, pemrograman, dan penalaran, mengungguli Claude 3.5 Sonnet dan GPT-4-Turbo di papan peringkat LMSYS Chatbot Arena.
- Kedua model menunjukkan peningkatan signifikan dibandingkan Grok-1.5 dalam mengikuti instruksi, memberikan informasi faktual, dan penggunaan alat.
- Benchmark menunjukkan kinerja kompetitif dengan model-model terdepan lainnya dalam ilmu tingkat sarjana (GPQA), pengetahuan umum (MMLU, MMLU-Pro), dan matematika (MATH).
- Grok-2 mencapai hasil terbaik dalam penalaran matematika visual (MathVista) dan pertanyaan berbasis dokumen (DocVQA).
- API perusahaan akan mendukung penyebaran inferensi multi-wilayah dengan fitur keamanan yang ditingkatkan seperti autentikasi multi-faktor wajib.
Rilis ini menempatkan xAI di garis depan pengembangan AI dengan meningkatkan kemampuan penalaran inti melalui kluster komputasi baru dan pemahaman multimodal yang lebih luas.