Google telah memperkenalkan Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking, model native speech-to-speech yang dirancang untuk agen suara real-time yang mampu bernalar dan mengeksekusi alat tanpa mengganggu alur percakapan.
- Kedua model kini aktif di Gemini Live API dan Google AI Studio sebagai solusi terhosting.
- Gemini 3.8 Live berfokus pada skalabilitas dan efisiensi biaya, sementara Extended Thinking menambahkan kemampuan penalaran multi-langkah.
- Extended Thinking menduduki peringkat #1 pada Indeks Kualitas Speech to Speech dari Artificial Analysis dengan skor 82.6.
- Model-model ini mendukung pemanggilan fungsi asinkron, konteks visual, presisi alfanumerik, dan 97 bahasa.
- Harga ditetapkan sebesar $0.005/min untuk input audio dan $0.018/min untuk output audio melalui Live API.
Rilis ini menyediakan alternatif yang lebih ramping dibandingkan dengan pipa suara bertingkat (cascaded speech pipelines), memungkinkan pengembang membangun agen suara tingkat produksi dengan penggunaan alat terintegrasi dan latensi rendah.