OpenAI telah merilis hasil kinerja terukur pertama untuk Jalapeño, chip inferensi kustomnya, bersama dengan gambaran rinci tentang strategi komputasi "kecerdasan melimpah" yang terintegrasi. Perusahaan menguraikan bagaimana ia menggabungkan pusat data, chip, model, dan perangkat lunak untuk meningkatkan efisiensi dan ekonomi di seluruh sistemnya.

  • Jalapeño menghasilkan throughput puncak lebih tinggi per kilowatt dan latensi token lebih rendah daripada sistem komersial pada benchmark InferenceX menggunakan GPT-OSS 120B.
  • Chip ini menunjukkan kinerja kuat pada DeepSeek R1 dan Kimi K2, mendemonstrasikan peningkatan di berbagai keluarga model.
  • OpenAI mengelola portofolio perangkat keras yang beragam termasuk Microsoft, NVIDIA, AWS, AMD, Broadcom, Cerebras, CoreWeave, Oracle, SB Energy, dan SoftBank.
  • GPT-5.6 Sol dengan penalaran maksimal mencapai rekor tertinggi pada Artificial Analysis Coding Agent Index sambil menggunakan 54% lebih sedikit token keluaran dibandingkan model terkemuka.

Pendekatan ini bertujuan untuk memberikan kontrol yang lebih besar atas ekonomi penyajian model dan menciptakan jalur silikon pihak pertama yang kredibel, memastikan kinerja terkuat per dolar seiring evolusi teknologi.