OpenAI опубликовала предварительные результаты производительности Jalapeño, своего первого собственного чипа для вывода моделей, демонстрирующие значительное улучшение скорости и энергоэффективности по сравнению с существующими коммерческими системами. Компания заявляет, что новая архитектура позволяет одновременно достигать более высокой пропускной способности и меньшей задержки, решая типичный компромисс в современном аппаратном обеспечении.
- Jalapeño обеспечивает выполнение от 1,5 до 1,9 раза больше ИИ-задач на ватт при пиковой пропускной способности по сравнению с системами-аналогами.
- Конечная задержка снизилась в 1,7–3,6 раза для протестированных моделей, включая GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 1T.
- Для высокоинтерактивных рабочих нагрузок чип обеспечивает производительность в 2,1–4,1 раза выше.
- Система поддерживает стабильное энергопотребление на уровне или ниже 550 Вт, несмотря на номинальную мощность в 700 Вт.
Эти улучшения призваны сделать всё более мощные ИИ-системы более доступными и широко распространёнными за счёт снижения стоимости получения результатов и поддержки более быстрой итерации для агентных рабочих нагрузок.