أطلقت OpenAI نموذج GPT-Live-1 في واجهة برمجة التطبيقات، مما يوفر للمطورين نموذجاً واحداً قادراً على الاستماع والتحدث في وقت واحد لبناء تطبيقات مدعومة بالصوت. تهدف هذه الإصدار إلى تبسيط تطوير طبقة الصوت من خلال استبدال البنى المتسلسلة التقليدية بنهج موحد يتعامل مع المقاطعات والسياق بشكل أكثر طبيعية.

تشمل القدرات الرئيسية تحسين التعامل مع المقاطعات عبر الاستدلال المشترك على الصوت الوارد والصادر، وإمكانية تفويض مهام الاستدلال الأعمق إلى نماذج الخلفية مثل GPT-6 Astra أو الأنظمة التابعة لطرف ثالث. يدعم النموذج تخصيص النبرة والسرعة والأسلوب من خلال المطالبات النظامية، ويتعامل بفعالية مع ضوضاء الخلفية والصمت، ويضمن الموثوقية عبر الجلسات الطويلة.

أظهرت التقييمات أن GPT-Live-1 يحسن أداء Full Duplex Bench بنسبة 30 نقطة مئوية مقارنة بـ GPT-Realtime-2.1، ويتصدر المرتبة الأولى على معيار Tau3 لذكاء وكلاء الصوت عند اقترانه بـ GPT-6 Astra. أصبح متاحاً اليوم بسعر 0.05 دولار لكل دقيقة لطبقة الصوت الأمامية، مع خطط لتوسيع خيارات الصوت وتوفر اللغات خلال الأشهر القادمة.