OpenAI запускает предварительную версию Ultrafast, нового уровня обслуживания, который работает с моделью GPT-5.6 Sol до 14 раз быстрее, чем стандартная обработка. Работая на оборудовании Cerebras, этот режим генерирует до 750 выходных токенов в секунду и изначально доступен через API OpenAI.

Сервис предназначен для рабочих процессов, чувствительных ко времени, где критически важна интеллектуальная обработка в реальном времени, включая:

  • Реагирование на инциденты и обеспечение надежности для анализа журналов во время сбоев.
  • Финансовые исследования и безопасность для оценки меняющихся рыночных сигналов.
  • Поддержка клиентов и голосовые сервисы для решения сложных задач без прерывания разговоров.
  • Торговые приложения, такие как персонализированные рекомендации и помощь при оформлении заказа.
  • Проведение исследований и экспериментов в реальном времени для обеспечения интерактивных рабочих сессий.

OpenAI утверждает, что Ultrafast позволяет компаниям создавать более отзывчивые продукты и принимать решения быстрее, внедряя передовую интеллектуальность в сложные рабочие процессы без потери скорости.