अलibaba क्वेन टीम ने Qwen3.8-LiveTranslate जारी किया है, जो एक अगली पीढ़ी का रियल-टाइम सिमुल्टेनस इंटर्प्रिटेशन मॉडल है जो लाइव स्पीच सुनता है और वक्ता अभी भी बोल रहा हो तभी अनुवादित टेक्स्ट और ऑडियो लौटाता है। इस रिलीज में लेटेंसी कम करने और अनुवाद गुणवत्ता को बेहतर बनाने के लिए डिज़ाइन किया गया एक नया इंटरलीव आर्किटेक्चर पेश किया गया है।

  • औसत लेगिंग (LAAL) 2.8 सेकंड से घटकर 2.3 सेकंड हो गई है, जो लगभग 18% की सुधार है।
  • मॉडल समझने के लिए 60 भाषाओं का समर्थन करता है और उनमें से 29 को बोल सकता है।
  • नई क्षमताओं में रियल-टाइम स्पीकर डायरिज़ेशन, सिंकनाइज्ड बाइलिंगुअल डिस्प्ले, और लॉन्ग-कंटैक्स्ट डिस्अम्बिगुएशन शामिल हैं।
  • यह शोर भरे वातावरण में दृश्य संकेतों की सहायता के लिए ऑडियो और वैकल्पिक वीडियो इनपुट स्वीकार करता है।
  • अलibaba क्लाउड मॉडल स्टूडियो और QwenCloud पर WebSocket API के माध्यम से उपलब्ध है।

मॉडल को होस्टेड API के रूप में तैनात किया गया है, जिससे डेवलपर्स विशिष्ट कीमत स्तरों वाले ऑडियो और टेक्स्ट इनपुट/आउटपुट के साथ रियल-टाइम इंटर्प्रिटेशन को एप्लिकेशनों में एकीकृत कर सकते हैं।