OpenAI está lanzando una versión preliminar de Ultrafast, un nuevo nivel de servicio que ejecuta el modelo GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento estándar. Impulsado por hardware de Cerebras, este modo genera hasta 750 tokens de salida por segundo y está disponible inicialmente a través de la API de OpenAI.
El servicio está dirigido a flujos de trabajo sensibles al tiempo donde la inteligencia en tiempo real es crítica, incluyendo:
- Respuesta a incidentes y confiabilidad para analizar registros durante interrupciones.
- Investigación financiera y seguridad para evaluar señales de mercado cambiantes.
- Atención al cliente y voz para resolver problemas complejos sin interrumpir las conversaciones.
- Aplicaciones comerciales como recomendaciones personalizadas y asistencia en el pago.
- Investigación y experimentación en vivo para permitir sesiones de trabajo interactivas.
OpenAI afirma que Ultrafast permite a las empresas construir productos más receptivos y tomar decisiones más rápidas al llevar la inteligencia de vanguardia a flujos de trabajo exigentes sin sacrificar velocidad.