OpenAI ha anunciado importantes reducciones de precios para sus modelos GPT-5.6, impulsadas por mejoras sistémicas de eficiencia y técnicas de autooptimización recursiva. La compañía informa que el costo de la inteligencia de nivel GPT-5.4 ha disminuido aproximadamente 13 veces en cuatro meses, con los precios de GPT-5.6 Luna recortados un 80% y Terra un 20%.
- OpenAI utilizó GPT-5.6 Sol para reescribir autónomamente los núcleos de producción en Triton y Gluon, reduciendo los costos de servicio de extremo a extremo en un 20%.
- La decodificación especulativa mejorada aumentó la eficiencia de generación de tokens en más del 15% mediante cientos de experimentos automatizados.
- Las optimizaciones de arneses agénticos, incluyendo descubrimiento diferido y almacenamiento en caché de prompts, redujeron los costos de cómputo repetitivo para herramientas como Codex.
- Una nueva capa "Sol Fast" ofrece una latencia 2.5 veces menor por el doble del precio estándar, mientras que se espera que los flujos de trabajo de agentes downstream vean costos aproximadamente 10 veces menores.
Estos cambios posicionan a OpenAI como altamente rentable para la inteligencia no ajustada finamente, con observadores señalando que el rendimiento insignia de marzo ahora está disponible por una fracción de su precio anterior por token.