OpenAI запускает предварительную версию Ultrafast, нового уровня обслуживания, который работает с моделью GPT-5.6 Sol до 14 раз быстрее, чем стандартная обработка. Работая на оборудовании Cerebras, этот режим генерирует до 750 выходных токенов в секунду и изначально доступен через API OpenAI.
Сервис предназначен для рабочих процессов, чувствительных ко времени, где критически важна интеллектуальная обработка в реальном времени, включая:
- Реагирование на инциденты и обеспечение надежности для анализа журналов во время сбоев.
- Финансовые исследования и безопасность для оценки меняющихся рыночных сигналов.
- Поддержка клиентов и голосовые сервисы для решения сложных задач без прерывания разговоров.
- Торговые приложения, такие как персонализированные рекомендации и помощь при оформлении заказа.
- Проведение исследований и экспериментов в реальном времени для обеспечения интерактивных рабочих сессий.
OpenAI утверждает, что Ultrafast позволяет компаниям создавать более отзывчивые продукты и принимать решения быстрее, внедряя передовую интеллектуальность в сложные рабочие процессы без потери скорости.