A OpenAI anunciou reduções significativas nos preços de seus modelos GPT-5.6, impulsionadas por melhorias sistêmicas de eficiência e técnicas de auto-otimização recursiva. A empresa relata que o custo da inteligência de nível GPT-5.4 caiu aproximadamente 13 vezes em quatro meses, com os preços do GPT-5.6 Luna cortados em 80% e o Terra em 20%.

  • A OpenAI utilizou o GPT-5.6 Sol para reescrever autonomamente os kernels de produção no Triton e Gluon, reduzindo os custos de serviço ponta a ponta em 20%.
  • O decodificação especulativa aprimorada aumentou a eficiência da geração de tokens em mais de 15% por meio de centenas de experimentos automatizados.
  • Otimizações do harness agêntico, incluindo descoberta diferida e armazenamento em cache de prompts, reduziram os custos de computação repetitiva para ferramentas como o Codex.
  • Uma nova camada "Sol Fast" oferece latência 2,5 vezes menor pelo dobro do preço padrão, enquanto espera-se que os fluxos de trabalho de agentes downstream vejam uma redução de custos de aproximadamente 10 vezes.

Essas mudanças posicionam a OpenAI como altamente econômica para inteligência não ajustada fino, com observadores notando que o desempenho principal de março agora está disponível por uma fração do seu preço anterior por token.