OpenAI ha lanzado la familia de modelos GPT-5.6, diseñada para ofrecer un rendimiento de agente de nivel fronterizo a costos significativamente menores mediante la optimización del esfuerzo de razonamiento y la introducción de nuevos controles de API. La actualización permite a las startups construir agentes más rápidos y capaces utilizando modelos más pequeños como Luna y Terra para tareas de alto volumen, mientras reserva los modelos más grandes para juicios complejos.
- GPT-5.6 Sol con razonamiento "bajo" supera a GPT-5.5 con razonamiento "alto" en el Último Examen de Agentes bajo condiciones constantes del arnés.
- En la prueba BrowseComp, GPT-5.6 Luna obtuvo un 84.04% por $1.33, en comparación con el 84.36% de GPT-5.5 por $33.27.
- Los nuevos primitivos de la API de Respuestas incluyen razonamiento persistente, compacción nativa, orquestación multi-agente y llamada de herramientas programática.
- Habilitar el razonamiento retenido y la compacción en ARC-AGI-3 aumentó la puntuación de GPT-5.6 Sol del 13.3% al 38.3% mientras usaba aproximadamente 6 veces menos tokens de salida.
- El TTL de caché de prompt se extiende a un mínimo de 30 minutos con puntos de quiebre de caché deterministas para mejorar las tasas de acierto y reducir la latencia.
Estos cambios cambian la economía de construir agentes, permitiendo resultados comparables o mejores a una fracción del costo mediante el uso de modelos más pequeños y elecciones arquitectónicas eficientes.