xAI telah mengumumkan Grok-1.5, sebuah model baru yang memiliki kemampuan penalaran yang ditingkatkan dan jendela konteks hingga 128.000 token. Model ini akan tersedia untuk penguji awal dan pengguna yang ada di platform 𝕏 dalam beberapa hari mendatang.
- Mencapai 50,6% pada benchmark MATH dan 90% pada GSM8K untuk tugas matematika.
- Meraih skor 74,1% pada benchmark HumanEval untuk generasi kode.
- Mendukung panjang konteks 128K token, meningkatkan kapasitas memori sebanyak 16 kali lipat.
- Menunjukkan hasil pengambilan ulang yang sempurna dalam evaluasi Needle In A Haystack.
- Dibangun di atas kerangka pelatihan terdistribusi khusus menggunakan JAX, Rust, dan Kubernetes.
Rilis ini bertujuan untuk memberikan pengguna kemampuan pemecahan masalah tingkat lanjut dan kapasitas untuk memproses dokumen yang jauh lebih panjang sambil mempertahankan akurasi penurutan instruksi.