OpenAI telah merilis hasil kinerja awal untuk Jalapeño, chip inferensi kustom pertamanya, yang menunjukkan peningkatan signifikan dalam kecepatan dan efisiensi daya dibandingkan dengan sistem komersial yang ada. Perusahaan menyatakan bahwa arsitektur baru ini memungkinkan throughput lebih tinggi dan latensi lebih rendah secara bersamaan, mengatasi trade-off umum pada perangkat keras saat ini.
- Jalapeño menghasilkan 1,5 hingga 1,9 kali lebih banyak kerja AI per watt pada throughput puncak dibandingkan sistem pembanding.
- Latensi end-to-end berkurang 1,7 hingga 3,6 kali di seluruh model yang diuji termasuk GPT-OSS 120B, DeepSeek R1, dan Kimi K2.5 1T.
- Untuk beban kerja yang sangat interaktif, chip ini memberikan kinerja lebih tinggi sebesar 2,1 hingga 4,1 kali.
- Sistem mencapai daya tarik berkelanjutan pada atau di bawah 550 watt meskipun memiliki rating 700 watt.
Peningkatan ini bertujuan membuat AI yang semakin mampu menjadi lebih terjangkau dan tersedia secara luas dengan menurunkan biaya pengiriman hasil yang sukses sambil mendukung iterasi lebih cepat untuk beban kerja agentic.