OpenAI опубликовала первые измеренные результаты производительности Jalapeño, своего собственного чипа для вывода моделей, а также подробный обзор своей интегрированной стратегии вычислений «избыточный интеллект». Компания описывает, как она объединяет центры обработки данных, чипы, модели и программное обеспечение для повышения эффективности и экономической целесообразности во всей своей системе.
- Jalapeño показал более высокую пиковую пропускную способность на киловатт и меньшую задержку токенов по сравнению с коммерческими системами в бенчмарке InferenceX при использовании GPT-OSS 120B.
- Чип продемонстрировал высокие результаты на задачах DeepSeek R1 и Kimi K2, показав улучшение показателей в различных семействах моделей.
- OpenAI управляет разнообразным портфелем оборудования, включая решения от Microsoft, NVIDIA, AWS, AMD, Broadcom, Cerebras, CoreWeave, Oracle, SB Energy и SoftBank.
- GPT-5.6 Sol с максимальным рассуждением достиг нового рекорда в Индексе кодовых агентов Artificial Analysis, используя на 54% меньше выходных токенов по сравнению с ведущей моделью.
Этот подход направлен на обеспечение большего контроля над экономикой обслуживания моделей и создание надежного пути первого лица для разработки кремния, гарантируя наилучшую производительность за доллар по мере развития технологий.