A OpenAI anunciou reduções significativas nos preços de seus modelos GPT-5.6, impulsionadas por melhorias sistêmicas de eficiência e técnicas de auto-otimização recursiva. A empresa relata que o custo da inteligência de nível GPT-5.4 caiu aproximadamente 13 vezes em quatro meses, com os preços do GPT-5.6 Luna cortados em 80% e o Terra em 20%.
- A OpenAI utilizou o GPT-5.6 Sol para reescrever autonomamente os kernels de produção no Triton e Gluon, reduzindo os custos de serviço ponta a ponta em 20%.
- O decodificação especulativa aprimorada aumentou a eficiência da geração de tokens em mais de 15% por meio de centenas de experimentos automatizados.
- Otimizações do harness agêntico, incluindo descoberta diferida e armazenamento em cache de prompts, reduziram os custos de computação repetitiva para ferramentas como o Codex.
- Uma nova camada "Sol Fast" oferece latência 2,5 vezes menor pelo dobro do preço padrão, enquanto espera-se que os fluxos de trabalho de agentes downstream vejam uma redução de custos de aproximadamente 10 vezes.
Essas mudanças posicionam a OpenAI como altamente econômica para inteligência não ajustada fino, com observadores notando que o desempenho principal de março agora está disponível por uma fração do seu preço anterior por token.