OpenAI запустила GPT-Live-1 в API, предоставив разработчикам единую модель, способную одновременно слушать и говорить для создания приложений с голосовым управлением. Этот релиз направлен на упрощение разработки голосового слоя за счёт замены традиционных цепочечных архитектур единым подходом, который более естественно обрабатывает прерывания и контекст.

Ключевые возможности включают улучшенную обработку прерываний благодаря совместному рассуждению над входящим и исходящим аудио, а также возможность делегирования задач глубокого рассуждения бэкенд-моделям, таким как GPT-6 Astra, или сторонним системам. Модель поддерживает настройку тона, темпа и стиля через системные промпты, эффективно справляется с фоновым шумом и тишиной, а также обеспечивает надёжность в течение длительных сессий.

Оценки показывают, что GPT-Live-1 улучшает показатели Full Duplex Bench на 30 процентных пунктов по сравнению с GPT-Realtime-2.1 и занимает 1-е место в бенчмарке Tau3 для интеллекта голосовых агентов при использовании вместе с GPT-6 Astra. Она доступна уже сегодня по цене $0.05 за минуту для фронтенд-слоя голосового взаимодействия, при этом в ближайшие месяцы планируется расширение вариантов голоса и доступных языков.