OpenAI发布了其定制推理芯片Jalapeño的首批实测性能结果,并详细介绍了其整合的“丰裕智能”计算策略。该公司概述了如何将数据中心、芯片、模型和软件相结合,以提升整个系统的效率和经济效益。

  • 在InferenceX基准测试中,使用GPT-OSS 120B时,Jalapeño每千瓦的峰值吞吐量更高,且令牌延迟更低,优于商用系统。
  • 该芯片在DeepSeek R1和Kimi K2上表现强劲,展示了在不同模型系列中的性能提升。
  • OpenAI管理着多样化的硬件组合,包括Microsoft、NVIDIA、AWS、AMD、Broadcom、Cerebras、CoreWeave、Oracle、SB Energy和SoftBank。
  • GPT-5.6 Sol在启用最大推理能力时,在Artificial Analysis Coding Agent Index上创下新高,同时比领先模型少使用54%的输出令牌。

该方法旨在对模型服务经济施加更大控制,并为硅片开发建立可信的自有路径,确保随着技术发展实现每美元最强的性能。