Google telah merilis Gemini 3.8 Flash TTS dan Flash-Lite TTS melalui API Gemini dan AI Studio, mencapai peringkat teratas di Voice Design Benchmark dan Voice Arena Hume di enam bahasa.

  • Pengguna sekarang dapat mereplikasi suara dengan merekam dua klip berbasis persetujuan atau merancang suara baru dari satu kalimat tanpa rekaman sebelumnya.
  • API mendukung efek suara inline seperti <short pause> dan gaya penyampaian terperinci melalui speech_metadata.style.
  • Suara yang direplikasi dapat digunakan kembali, sementara suara tanpa persetujuan dapat disimpan sebagai kunci terenkripsi yang kedaluwarsa setelah tujuh hari.
  • Prompting telah berubah secara signifikan: instruksi di dalam teks diucapkan keras-keras, giliran multi-pembicara memerlukan tag pembicara eksplisit, dan prompt Audio Profile panjang dapat menyebabkan drift suara.

Pembaruan ini memungkinkan kontrol presisi atas generasi suara sintetis, meskipun prompt yang ada dari versi gemini-3.1-flash-tts-preview akan rusak tanpa migrasi.