OpenAI ha lanzado la familia de modelos GPT-5.6, diseñada para ofrecer un rendimiento de agente de nivel fronterizo a costos significativamente menores mediante la optimización del esfuerzo de razonamiento y la introducción de nuevos controles de API. La actualización permite a las startups construir agentes más rápidos y capaces utilizando modelos más pequeños como Luna y Terra para tareas de alto volumen, mientras reserva los modelos más grandes para juicios complejos.

  • GPT-5.6 Sol con razonamiento "bajo" supera a GPT-5.5 con razonamiento "alto" en el Último Examen de Agentes bajo condiciones constantes del arnés.
  • En la prueba BrowseComp, GPT-5.6 Luna obtuvo un 84.04% por $1.33, en comparación con el 84.36% de GPT-5.5 por $33.27.
  • Los nuevos primitivos de la API de Respuestas incluyen razonamiento persistente, compacción nativa, orquestación multi-agente y llamada de herramientas programática.
  • Habilitar el razonamiento retenido y la compacción en ARC-AGI-3 aumentó la puntuación de GPT-5.6 Sol del 13.3% al 38.3% mientras usaba aproximadamente 6 veces menos tokens de salida.
  • El TTL de caché de prompt se extiende a un mínimo de 30 minutos con puntos de quiebre de caché deterministas para mejorar las tasas de acierto y reducir la latencia.

Estos cambios cambian la economía de construir agentes, permitiendo resultados comparables o mejores a una fracción del costo mediante el uso de modelos más pequeños y elecciones arquitectónicas eficientes.