Google telah merilis dua model speech-to-speech baru, Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking, yang mirip dalam bentuk dengan model GPT-Live dari OpenAI.
- Rilis ini mencakup Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking.
- UI web memungkinkan pengguna memilih model dan preset suara, memasukkan prompt sistem opsional, dan memulai percakapan suara melalui browser.
- Pengguna dapat mengganggu model saat sedang berbicara, dengan transkrip menangkap gangguan tersebut.
- Implementasi terhubung ke endpoint WebSocket dan menggunakan Web Audio API untuk tangkapan dan pemutaran tanpa pustaka eksternal.