Google telah merilis dua model speech-to-speech baru, Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking, yang mirip dalam bentuk dengan model GPT-Live dari OpenAI.

  • Rilis ini mencakup Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking.
  • UI web memungkinkan pengguna memilih model dan preset suara, memasukkan prompt sistem opsional, dan memulai percakapan suara melalui browser.
  • Pengguna dapat mengganggu model saat sedang berbicara, dengan transkrip menangkap gangguan tersebut.
  • Implementasi terhubung ke endpoint WebSocket dan menggunakan Web Audio API untuk tangkapan dan pemutaran tanpa pustaka eksternal.