OpenAI ha presentado GPT-6 Astra como su modelo más inteligente hasta la fecha, mientras esboza su estrategia de cómputo de pila completa, que incluye el nuevo chip de inferencia Jalapeño. La compañía informa que su hardware personalizado ofrece un pico de rendimiento de tokens por vatio entre 1,5 y 1,9 veces mayor en comparación con los sistemas comerciales en las pruebas de InferenceX.
- GPT-6 Astra se describe como líder en el uso de computadoras, navegación, ingeniería de software, ciberseguridad, ciencia y trabajo profesional.
- El chip de inferencia Jalapeño reduce la latencia de extremo a extremo entre 1,7 y 3,6 veces en comparación con los sistemas comerciales evaluados.
- GPT-5.6 Sol mejoró el software de servicio de producción, reduciendo los costos de servicio de extremo a extremo en un 20 % e incrementando la eficiencia de generación de tokens en más del 15 por ciento.
- La organización de investigación de OpenAI ahora utiliza 3,1 días-agente de esfuerzo por cada día laboral de trabajo humano.
Estos avances tienen como objetivo reducir el costo y aumentar la velocidad de las tareas de IA, permitiendo a los clientes lograr más con menos intentos mientras apoyan el crecimiento de OpenAI a través de fuentes de ingresos diversificadas.