OpenAI ने अपने पहले कस्टम इनफरेंस चिप, जलापेनो के लिए प्रारंभिक प्रदर्शन परिणाम जारी किए हैं, जो मौजूदा वाणिज्यिक सिस्टम की तुलना में गति और पावर दक्षता में महत्वपूर्ण सुधार दिखाते हैं। कंपनी का कहना है कि नई आर्किटेक्चर एक साथ उच्च थ्रूपुट और कम लेटेंसी को संभव बनाती है, जो वर्तमान हार्डवेयर में एक सामान्य समझौता है।

  • जलापेनो ने शीर्ष थ्रूपुट पर तुलनात्मक सिस्टम की तुलना में प्रति वाट 1.5 से 1.9 गुना अधिक AI कार्य किया।
  • GPT-OSS 120B, DeepSeek R1 और Kimi K2.5 1T सहित परीक्षण किए गए मॉडलों के लिए एंड-टू-एंड लेटेंसी 1.7 से 3.6 गुना कम हो गई।
  • अत्यंत इंटरैक्टिव वर्कलोड्स के लिए, चिप ने 2.1 से 4.1 गुना अधिक प्रदर्शन प्रदान किया।
  • सिस्टम ने 700 वाट की रेटिंग के बावजूद 550 वाट या उससे कम की स्थिर पावर ड्रॉ हासिल की।

ये सुधार सफल परिणामों को प्रदान करने की लागत को कम करके और एजेंटिक वर्कलोड्स के लिए तेज़ पुनरावृत्ति का समर्थन करते हुए, बढ़ती क्षमता वाले AI को अधिक किफायती और व्यापक रूप से उपलब्ध बनाने के उद्देश्य से हैं।