OpenAI a annoncé des baisses de prix significatives pour ses modèles GPT-5.6, motivées par des améliorations systémiques d'efficacité et des techniques d'auto-optimisation récursive. L'entreprise signale que le coût de l'intelligence de niveau GPT-5.4 a chuté d'environ 13x en quatre mois, avec les prix de GPT-5.6 Luna réduits de 80 % et Terra de 20 %.

  • OpenAI a utilisé GPT-5.6 Sol pour réécrire autonomement les noyaux de production dans Triton et Gluon, réduisant les coûts de service de bout en bout de 20 %.
  • Le décodage spéculatif amélioré a augmenté l'efficacité de la génération de tokens de plus de 15 % grâce à des centaines d'expériences automatisées.
  • Les optimisations du cadre agentic, incluant la découverte différée et la mise en cache des prompts, ont réduit les coûts de calcul répétitifs pour des outils comme Codex.
  • Un nouveau niveau « Sol Fast » offre une latence 2,5x plus faible pour le double du prix standard, tandis que les flux de travail d'agents en aval devraient voir leurs coûts baisser d'environ 10x.

Ces changements positionnent OpenAI comme hautement rentable pour l'intelligence non affinée, les observateurs notant que la performance phare de mars est désormais disponible à une fraction de son prix par token précédent.