A OpenAI está lançando uma prévia do Ultrafast, um novo nível de serviço que executa o modelo GPT-5.6 Sol até 14 vezes mais rápido do que o processamento padrão. Alimentado por hardware da Cerebras, este modo gera até 750 tokens de saída por segundo e está inicialmente disponível via API da OpenAI.
O serviço visa fluxos de trabalho sensíveis ao tempo onde a inteligência em tempo real é crítica, incluindo:
- Resposta a incidentes e confiabilidade para analisar logs durante interrupções.
- Pesquisa financeira e segurança para avaliar sinais de mercado em mudança.
- Suporte ao cliente e voz para resolver problemas complexos sem interromper as conversas.
- Aplicações comerciais como recomendações personalizadas e assistência no checkout.
- Pesquisa e experimentação ao vivo para permitir sessões de trabalho interativas.
A OpenAI afirma que o Ultrafast permite que as empresas construam produtos mais responsivos e tomem decisões mais rápidas, trazendo inteligência de fronteira para fluxos de trabalho exigentes sem sacrificar a velocidade.