Google telah memperkenalkan pemahaman video agentic untuk model Gemini terbarunya, memungkinkan analisis dinamis yang mengurangi penggunaan token hingga 88% sambil meningkatkan akurasi hingga 7%. Kemampuan ini memungkinkan model secara aktif mencari dan memeriksa segmen video tertentu alih-alih memproses frame pada laju tetap.

Fitur ini tersedia melalui Gemini API di Google AI Studio dan platform Gemini Enterprise Agent Platform. Kemampuan utama meliputi pengambilan momen dalam waktu kurang dari satu detik, pencarian «jarum dalam tumpukan jerami» untuk konten panjang, deteksi anomali, dan penghitungan akurat tindakan serta objek. Mitra akses awal melaporkan kinerja yang kuat, dengan Gemini 3.7 Flash mencapai efisiensi akurasi-terhadap-biaya terbaik.

Google berencana meluncurkan peningkatan ini ke miliaran pengguna di aplikasi Gemini dan akan menggerakkan fitur 'Ask YouTube' di YouTube dalam beberapa bulan mendatang.