PolyAI telah memperkenalkan Dialog-RSN-1, sebuah model dialog yang memproses audio panggilan mentah secara langsung daripada mengandalkan transkrip. Ini menggabungkan pergantian giliran, pengenalan suara, pemanggilan fungsi, dan generasi respons ke dalam satu sistem sadar audio.

  • Model ini mengeluarkan token pertama sebagai EMPTY, ONGOING, atau COMPLETE untuk mengelola pergantian giliran.
  • Ini berjalan sebagai LLM berbasis permintaan yang dipicu sesuai permintaan alih-alih aliran yang selalu aktif.
  • PolyAI melaporkan respons di bawah 300ms, peningkatan 11% dalam kontainment relatif di grup restoran, dan pengurangan latensi sebesar −37% di perusahaan asuransi.
  • Sistem ini hanya tersedia dalam bahasa Inggris saat peluncuran dan dikirim melalui platform PolyAI tanpa bobot terbuka.

Dialog-RSN-1 sudah menangani panggilan produksi langsung untuk pelanggan yang ada, dengan akses baru tersedia melalui permintaan awal.