A OpenAI lançou a família de modelos GPT-5.6, projetada para entregar desempenho de agente de nível fronteira com custos significativamente menores, otimizando o esforço de raciocínio e introduzindo novos controles de API. A atualização permite que startups construam agentes mais rápidos e capazes usando modelos menores como Luna e Terra para tarefas de alto volume, enquanto reservam modelos maiores para julgamentos complexos.
- O GPT-5.6 Sol com raciocínio "baixo" supera o GPT-5.5 com raciocínio "alto" no Agents’ Last Exam sob condições constantes de harness.
- No benchmark BrowseComp, o GPT-5.6 Luna marcou 84,04% por US$ 1,33, comparado aos 84,36% do GPT-5.5 por US$ 33,27.
- Os novos primitivos da API de Respostas incluem raciocínio persistente, compactação nativa, orquestração multi-agente e chamada programática de ferramentas.
- Habilitar raciocínio retido e compactação no ARC-AGI-3 aumentou a pontuação do GPT-5.6 Sol de 13,3% para 38,3%, enquanto usava aproximadamente 6x menos tokens de saída.
- O TTL do cache de prompt foi estendido para um mínimo de 30 minutos com pontos de quebra de cache determinísticos para melhorar as taxas de acerto e reduzir a latência.
Essas mudanças alteram a economia da construção de agentes, permitindo resultados comparáveis ou melhores por uma fração do custo ao usar modelos menores e escolhas arquitetônicas eficientes.