OpenAI telah memperkenalkan GPT-6 Astra sebagai model paling cerdas hingga saat ini sambil menguraikan strategi komputasi full-stack-nya, yang mencakup chip inferensi Jalapeño baru. Perusahaan melaporkan bahwa perangkat keras kustomnya menghasilkan throughput token puncak per watt 1,5 hingga 1,9 kali lebih tinggi dibandingkan sistem komersial dalam pengujian InferenceX.
- GPT-6 Astra digambarkan sebagai state-of-the-art dalam penggunaan komputer, penjelajahan web, rekayasa perangkat lunak, siber, ilmu pengetahuan, dan pekerjaan profesional.
- Chip inferensi Jalapeño mengurangi latensi end-to-end sebesar 1,7 hingga 3,6 kali dibandingkan dengan sistem komersial yang diuji.
- GPT-5.6 Sol meningkatkan perangkat lunak penyajian produksi, mengurangi biaya penyajian end-to-end sebesar 20% dan meningkatkan efisiensi generasi token lebih dari 15 persen.
- Organisasi penelitian OpenAI kini memanfaatkan 3,1 hari kerja agen untuk setiap hari kerja tenaga manusia.
Kemajuan ini bertujuan menurunkan biaya dan meningkatkan kecepatan tugas AI, memungkinkan pelanggan mencapai lebih banyak dengan usaha yang lebih sedikit sambil mendukung pertumbuhan OpenAI melalui aliran pendapatan yang terdiversifikasi.