OpenAI está lanzando una versión preliminar de Ultrafast, un nuevo nivel de servicio que ejecuta el modelo GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento estándar. Impulsado por hardware de Cerebras, este modo genera hasta 750 tokens de salida por segundo y está disponible inicialmente a través de la API de OpenAI.

El servicio está dirigido a flujos de trabajo sensibles al tiempo donde la inteligencia en tiempo real es crítica, incluyendo:

  • Respuesta a incidentes y confiabilidad para analizar registros durante interrupciones.
  • Investigación financiera y seguridad para evaluar señales de mercado cambiantes.
  • Atención al cliente y voz para resolver problemas complejos sin interrumpir las conversaciones.
  • Aplicaciones comerciales como recomendaciones personalizadas y asistencia en el pago.
  • Investigación y experimentación en vivo para permitir sesiones de trabajo interactivas.

OpenAI afirma que Ultrafast permite a las empresas construir productos más receptivos y tomar decisiones más rápidas al llevar la inteligencia de vanguardia a flujos de trabajo exigentes sin sacrificar velocidad.