OpenAIは、独自開発の推論用チップ「Jalapeño」の最初の測定パフォーマンス結果と、統合された「豊富なインテリジェンス」コンピューティング戦略の詳細な概要を発表した。同社は、データセンター、チップ、モデル、ソフトウェアをどのように組み合わせて、システム全体の効率性と経済性を向上させているかを説明している。
- Jalapeñoは、GPT-OSS 120Bを使用してInferenceXベンチマークで商用システムよりも高いピークスループット(キロワットあたり)と低いトークンレイテンシを実現した。
- チップはDeepSeek R1およびKimi K2で強力なパフォーマンスを示し、異なるモデルファミリー全体で改善が見られた。
- OpenAIはMicrosoft、NVIDIA、AWS、AMD、Broadcom、Cerebras、CoreWeave、Oracle、SB Energy、SoftBankなどを含む多様なハードウェアポートフォリオを管理している。
- GPT-5.6 Sol(最大推論モード)は、主要モデルよりも出力トークンを54%削減しながら、Artificial Analysis Coding Agent Indexで新たな最高記録を達成した。
このアプローチは、モデルサービングの経済性に対するより大きな制御を提供し、シリコン分野における信頼性の高いファーストパーティの経路を作成することを目的としており、技術が進化する中でドルあたりのパフォーマンスを最大限に確保する。