Google dan Google DeepMind telah memperkenalkan Gemini 1.0, keluarga baru model multimodal skala besar yang dirancang untuk memahami dan menggabungkan teks, kode, audio, gambar, dan video secara native.
- Versi pertama mencakup tiga ukuran yang dioptimalkan: Gemini Ultra untuk tugas kompleks, Gemini Pro untuk penskalaan lintas tugas, dan Gemini Nano untuk efisiensi di perangkat.
- Gemini Ultra mencapai kinerja state-of-the-art pada 30 dari 32 benchmark akademik yang banyak digunakan dan merupakan model pertama yang mengungguli ahli manusia pada MMLU dengan skor 90.0%.
- Model-model ini dibangun dari dasar sebagai multimodal, memungkinkan mereka bernalar tentang input beragam tanpa bergantung pada komponen terpisah yang disatukan.
Rilis ini mewakili langkah signifikan dalam membangun AI tujuan umum yang dapat meningkatkan cara pengembang dan perusahaan membangun serta menskalakan aplikasi.