OpenAI telah mengumumkan pengurangan harga yang signifikan untuk model-model GPT-5.6-nya, didorong oleh peningkatan efisiensi sistemik dan teknik optimisasi diri secara rekursif. Perusahaan melaporkan bahwa biaya kecerdasan tingkat GPT-5.4 telah turun sekitar 13 kali lipat dalam empat bulan, dengan harga GPT-5.6 Luna dipotong sebesar 80% dan Terra sebesar 20%.
- OpenAI memanfaatkan GPT-5.6 Sol untuk secara otonom menulis ulang kernel produksi di Triton dan Gluon, mengurangi biaya layanan end-to-end sebesar 20%.
- Peningkatan decoding spekulatif meningkatkan efisiensi generasi token lebih dari 15% melalui ratusan eksperimen otomatis.
- Optimisasi harness agentic, termasuk penemuan tertunda dan caching prompt, mengurangi biaya komputasi berulang untuk alat seperti Codex.
- Tier "Sol Fast" baru menawarkan latensi 2,5x lebih rendah dengan harga dua kali lipat dari standar, sementara alur kerja agen turunan diperkirakan akan mengalami penurunan biaya sekitar 10 kali lipat.
Perubahan ini menempatkan OpenAI sebagai pilihan yang sangat hemat biaya untuk kecerdasan non-finetuned, dengan pengamat mencatat bahwa kinerja unggulan bulan Maret kini tersedia dengan fraksi kecil dari harga token sebelumnya.