Perusahaan AI suara asal Paris, Gradium, telah meluncurkan Voice Design, sebuah fitur yang menghasilkan suara sintetis baru dari deskripsi tertulis tanpa memerlukan audio referensi. Alat ini kini tersedia di API dan Studio Gradium dalam lima bahasa.
- Pengguna memasukkan deskripsi berisi 1 hingga 500 karakter yang mendetailkan atribut seperti jenis kelamin, usia, aksen, dan nada untuk menerima hingga 5 kandidat suara dalam waktu 3 hingga 5 detik.
- Kandidat dihasilkan melalui alur REST empat panggilan, di mana suara yang dipilih dapat dipromosikan ke slot suara kustom permanen menggunakan satu slot yang dibagikan dengan salinan.
- Dalam tes pendengaran berpasangan buta yang mencakup 7.627 perbandingan, Gradium mencapai tingkat kemenangan 72,6% melawan pesaing seperti ElevenLabs dan Inworld.
- Sistem ini bersifat non-deterministik, artinya prompt yang sama menghasilkan hasil yang berbeda setiap kali, dan kandidat yang belum disimpan akan kedaluwarsa setelah 30 hari.
Hal ini memungkinkan pengembang membuat persona suara spesifik sesuai permintaan tanpa perlu memperoleh hak atau persetujuan dari pembicara asli.