Google telah memperkenalkan Gemini 2.5, keluarga terbaru model AI "berpikir" yang mampu bernalar melalui pemikiran sebelum memberikan respons. Rilis pertama adalah versi eksperimental dari Gemini 2.5 Pro, yang mencapai kinerja state-of-the-art pada berbagai benchmark dan debut di peringkat #1 pada leaderboard LMArena.

  • Gemini 2.5 Pro menduduki puncak leaderboard LMArena dengan selisih signifikan, menunjukkan gaya dan kemampuan berkualitas tinggi.
  • Model ini memimpin pada benchmark matematika dan sains seperti GPQA dan AIME 2025 tanpa menggunakan teknik saat pengujian seperti majority voting.
  • Model ini meraih skor state-of-the-art 18.8% pada Humanity’s Last Exam, sebuah dataset yang menangkap batas pengetahuan manusia.
  • Pada SWE-Bench Verified, Gemini 2.5 Pro mencetak skor 63.8% dengan setup agen kustom untuk evaluasi kode agentic.
  • Model ini memiliki jendela konteks 1 juta token, dengan 2 juta token akan segera hadir, mendukung teks, audio, gambar, video, dan repositori kode.

Gemini 2.5 Pro tersedia sekarang di Google AI Studio dan aplikasi Gemini untuk pengguna Advanced, dengan ketersediaan Vertex AI diharapkan dalam beberapa minggu ke depan.