OpenAI telah meluncurkan GPT-Live-1 di dalam API, menyediakan kepada pengembang satu model yang mampu mendengarkan dan berbicara secara bersamaan untuk membangun aplikasi berbasis suara. Rilis ini bertujuan menyederhanakan pengembangan lapisan suara dengan mengganti arsitektur berantai tradisional menggunakan pendekatan terpadu yang menangani interupsi dan konteks lebih alami.

Kemampuan utama meliputi penanganan interupsi yang lebih baik melalui penalaran gabungan atas audio masuk dan keluar, serta kemampuan mendelegasikan tugas penalaran mendalam ke model backend seperti GPT-6 Astra atau sistem pihak ketiga. Model ini mendukung kustomisasi nada, kecepatan, dan gaya melalui prompt sistem, mengelola kebisingan latar belakang dan keheningan secara efektif, serta memastikan keandalan selama sesi panjang.

Evaluasi menunjukkan GPT-Live-1 meningkatkan kinerja Full Duplex Bench sebesar 30 poin persentase dibandingkan GPT-Realtime-2.1 dan menduduki peringkat #1 pada benchmark Tau3 untuk kecerdasan agen suara ketika dipasangkan dengan GPT-6 Astra. Model ini tersedia hari ini dengan harga $0.05 per menit untuk lapisan suara front-end, dengan opsi suara dan ketersediaan bahasa yang diperluas direncanakan dalam beberapa bulan mendatang.