PolyAI представила Dialog-RSN-1, модель диалога, которая обрабатывает сырой голосовой вызов напрямую, а не полагается на транскрипты. Она объединяет управление очередями, распознавание речи, вызов функций и генерацию ответов в единую систему, aware аудио.

  • Модель выводит первый токен как EMPTY, ONGOING или COMPLETE для управления очередями.
  • Она работает как LLM по запросу, опрашиваемая по требованию, а не как всегда активный поток.
  • PolyAI сообщает о времени ответа менее 300 мс, увеличении относительного удержания на 11% в ресторанной группе и снижении задержки на 37% у страховщика.
  • Система доступна только на английском языке при запуске и предоставляется через платформу PolyAI без открытых весов.

Dialog-RSN-1 уже обрабатывает живые производственные звонки для существующих клиентов, новый доступ доступен по раннему запросу.