OpenAI가 API에 GPT-Live-1을 출시하여 개발자에게 음성 기반 애플리케이션 구축을 위해 동시에 청취와 발화가 가능한 단일 모델을 제공합니다. 이번 릴리스는 전통적인 연결된 아키텍처를 중단과 맥락을 더 자연스럽게 처리하는 통합 방식으로 대체함으로써 음성 레이어 개발을 간소화하는 것을 목표로 합니다.

주요 기능에는 들어오는 오디오와 나가는 오디오에 대한 결합 추론을 통한 개선된 중단 처리, GPT-6 Astra 또는 서드파티 시스템과 같은 백엔드 모델로 더 깊은 추론 작업을 위임할 수 있는 능력이 포함됩니다. 이 모델은 시스템 프롬프트를 통해 톤, 속도, 스타일 사용자 지정을 지원하며, 배경 소음과 침묵을 효과적으로 관리하고 긴 세션 전반에 걸쳐 신뢰성을 보장합니다.

평가 결과 GPT-Live-1은 GPT-Realtime-2.1 대비 풀 듀플렉스 벤치(Full Duplex Bench) 성능을 30%p 향상시켰으며, GPT-6 Astra와 결합 시 음성 에이전트 지능에 대한 Tau3 벤치마크에서 1위를 차지했습니다. 프론트엔드 음성 레이어에 대해 분당 $0.05의 가격으로 오늘부터 이용 가능하며, 향후 몇 달 동안 확장된 음성 옵션과 언어 지원이 예정되어 있습니다.