पेरिस स्थित वॉइस एआई कंपनी ग्रैडियम ने वॉइस डिज़ाइन लॉन्च किया है, जो संदर्भ ऑडियो की आवश्यकता के बिना लिखित विवरणों से नई सिंथेटिक आवाज़ें उत्पन्न करने वाला एक फीचर है। यह टूल अब ग्रैडियम एपीआई और स्टूडियो में पाँच भाषाओं में उपलब्ध है।

  • उपयोगकर्ता लिंग, आयु, उच्चारण और पिच जैसे गुणों का विवरण देने वाले 1 से 500 वर्ण के विवरण इनपुट करते हैं और 3 से 5 सेकंड में अधिकतम 5 आवाज़ उम्मीदवार प्राप्त करते हैं।
  • उम्मीदवार एक चार-चरण वाली REST फ्लो के माध्यम से उत्पन्न किए जाते हैं, जहाँ चुनी गई आवाज़ों को क्लोन के साथ साझा किए गए एक स्लॉट का उपयोग करके स्थाई कस्टम वॉइस स्लॉट में प्रमोट किया जा सकता है।
  • 7,627 तुलनाओं वाले अंधे युग्म श्रवण परीक्षणों में, ग्रैडियम ने एलेवनलैब्स और इनवर्ल्ड जैसे प्रतिस्पर्धियों के खिलाफ 72.6% जीत दर हासिल की।
  • सिस्टम नॉन-डिटरमिनिस्टिक है, जिसका अर्थ है कि समान प्रॉम्प्ट हर बार अलग परिणाम देता है, और बचाने वाले उम्मीदवार 30 दिनों के बाद समाप्त हो जाते हैं।

इससे डेवलपर्स को वास्तविक वक्ताओं के अधिकार या सहमति की खोज किए बिना आवश्यकतानुसार विशिष्ट आवाज़ व्यक्तित्व बनाने की सुविधा मिलती है।