Google telah merilis dua model teks-ke-suara baru, Gemini 3.8 Flash TTS dan Gemini 3.8 Flash-Lite TTS, memperluas keluarga Gemini Audio untuk menawarkan kemampuan generasi suara dinamis bagi kreator, pengembang, dan perusahaan.

  • Gemini 3.8 Flash TTS memungkinkan arahan kreatif mendalam, memungkinkan pengguna membuat suara baru dari awal menggunakan prompt bahasa alami dan mengontrol isyarat kinerja baris demi baris.
  • Gemini 3.8 Flash-Lite TTS dioptimalkan untuk skala volume tinggi yang efisien biaya, mendukung dubbing dan agen suara ekspresif dengan kontrol halus atas nada dan kecepatan.
  • Model-model ini mendukung lebih dari 100 bahasa dan dialek, termasuk variasi regional seperti Spanyol Meksiko dan Inggris Skotlandia, serta menawarkan pustaka lebih dari 2.000 suara siap produksi.
  • Fitur replikasi suara memungkinkan pengguna membuat ulang profil vokal dari sampel 30 detik, didukung oleh verifikasi persetujuan, watermarking SynthID, dan kredensial C2PA.
  • Kedua model meraih posisi teratas dalam benchmark Hume AI, dengan Gemini 3.8 Flash TTS memimpin Overall Quality Index dan Voice Design Benchmark.

Alat-alat ini kini tersedia di Google AI Studio dan Gemini API untuk pengembang, sementara akses perusahaan akan segera hadir melalui Gemini Enterprise.