Google telah merilis dua model teks-ke-suara baru, Gemini 3.8 Flash TTS dan Gemini 3.8 Flash-Lite TTS, sebagai bagian dari keluarga Gemini Audio. Model-model ini memperkenalkan desain suara generatif dari prompt bahasa alami dan arahan performa per baris melalui Gemini API dan Google AI Studio.
- Gemini 3.8 Flash TTS menargetkan arahan kreatif untuk game dan media imersif, peringkat #1 pada Hume AI Voice Design Benchmark dengan skor 71.4.
- Gemini 3.8 Flash-Lite TTS dioptimalkan untuk produksi bervolume tinggi dan hemat biaya seperti dubbing, serta peringkat #2 pada Hume AI Overall Quality Index.
- Rilis ini memperluas pustaka suara menjadi lebih dari 2.000 suara siap produksi dan memungkinkan desain generatif di lebih dari 100 bahasa.
- Kedua model mendukung panggung dua pembicara asli, ledakan vokal, backchanneling, dan generasi bentuk panjang dengan kualitas konsisten.
- Replikasi suara memerlukan sampel 30 detik dan persetujuan verbal, dengan semua output diberi watermark oleh SynthID.
Model-model ini memberikan pengembang kontrol granular atas nada, tempo, dan desain karakter sambil menawarkan opsi skalabel untuk berbagai kebutuhan produksi.