Google telah merilis Gemini 3.8 Flash TTS dan Flash-Lite TTS melalui API Gemini dan AI Studio, mencapai peringkat teratas di Voice Design Benchmark dan Voice Arena Hume di enam bahasa.
- Pengguna sekarang dapat mereplikasi suara dengan merekam dua klip berbasis persetujuan atau merancang suara baru dari satu kalimat tanpa rekaman sebelumnya.
- API mendukung efek suara inline seperti <short pause> dan gaya penyampaian terperinci melalui speech_metadata.style.
- Suara yang direplikasi dapat digunakan kembali, sementara suara tanpa persetujuan dapat disimpan sebagai kunci terenkripsi yang kedaluwarsa setelah tujuh hari.
- Prompting telah berubah secara signifikan: instruksi di dalam teks diucapkan keras-keras, giliran multi-pembicara memerlukan tag pembicara eksplisit, dan prompt Audio Profile panjang dapat menyebabkan drift suara.
Pembaruan ini memungkinkan kontrol presisi atas generasi suara sintetis, meskipun prompt yang ada dari versi gemini-3.1-flash-tts-preview akan rusak tanpa migrasi.