OpenAI telah meluncurkan keluarga model GPT-5.6, dirancang untuk memberikan kinerja agen tingkat terdepan dengan biaya yang jauh lebih rendah melalui optimasi upaya penalaran dan pengenalan kontrol API baru. Pembaruan ini memungkinkan startup membangun agen yang lebih cepat dan lebih mampu menggunakan model yang lebih kecil seperti Luna dan Terra untuk tugas bervolume tinggi sambil menyimpan model yang lebih besar untuk penilaian kompleks.
- GPT-5.6 Sol dengan penalaran "rendah" mengungguli GPT-5.5 dengan penalaran "tinggi" pada Ujian Terakhir Agen dengan kondisi harness yang konstan.
- Pada benchmark BrowseComp, GPT-5.6 Luna mencetak skor 84,04% seharga $1,33, dibandingkan dengan skor 84,36% milik GPT-5.5 seharga $33,27.
- Primitif API Respons baru mencakup penalaran yang disimpan, kompresi asli, orkestrasi multi-agen, dan pemanggilan alat secara terprogram.
- Mengaktifkan penalaran yang disimpan dan kompresi pada ARC-AGI-3 meningkatkan skor GPT-5.6 Sol dari 13,3% menjadi 38,3% sambil menggunakan sekitar 6x lebih sedikit token keluaran.
- TTL cache prompt diperpanjang hingga minimum 30 menit dengan titik putus cache deterministik untuk meningkatkan tingkat hit dan mengurangi latensi.
Perubahan-perubahan ini menggeser ekonomi pembangunan agen, memungkinkan hasil yang sebanding atau lebih baik dengan biaya sepersekian menggunakan model yang lebih kecil dan pilihan arsitektur yang efisien.