PolyAI ने Dialog-RSN-1 का परिचय दिया है, जो एक संवाद मॉडल है जो प्रतिलिपियों पर निर्भर करने के बजाय सीधे कालकर्ता के ऑडियो को प्रोसेस करता है। यह टर्न-टेकिंग, स्पीच रिकग्निशन, फंक्शन कॉलिंग और रिस्पॉन्स जनरेशन को एक ही ऑडियो-अवेयर सिस्टम में फ्यूज करता है।
- मॉडल टर्न-टेकिंग को प्रबंधित करने के लिए पहले टोकन को EMPTY, ONGOING, या COMPLETE के रूप में आउटपुट करता है।
- यह हमेशा ऑन स्ट्रीम के बजाय अनुरोध-आधारित LLM के रूप में चलता है जो आवश्यकतानुसार प्रोब किया जाता है।
- PolyAI ने 300ms से कम रिस्पॉन्स, एक रेस्टोरेंट ग्रुप में +11% सापेक्ष कंटेंमेंट और एक इंश्योरर पर −37% लेटेंसी की रिपोर्ट की है।
- सिस्टम लॉन्च पर केवल अंग्रेजी में है और बिना ओपन वेट्स के PolyAI की प्लेटफ़ॉर्म के माध्यम से डिलीवर किया गया है।
Dialog-RSN-1 पहले से मौजूदा ग्राहकों के लिए लाइव प्रोडक्शन कॉल्स संभाल रहा है, नई एक्सेस अर्ली रिक्वेस्ट के माध्यम से उपलब्ध है।