OpenAI发布了其首款定制推理芯片Jalapeño的初步性能结果,与现有商业系统相比,在速度和能效方面展现出显著提升。该公司表示,新架构能够同时实现更高的吞吐量和更低的延迟,解决了当前硬件中常见的权衡问题。

  • 在峰值吞吐量下,Jalapeño每瓦特提供的AI工作量比对比系统高出1.5至1.9倍。
  • 在包括GPT-OSS 120B、DeepSeek R1和Kimi K2.5 1T在内的测试模型中,端到端延迟降低了1.7至3.6倍。
  • 对于高度交互式的工作负载,该芯片提供了2.1至4.1倍的更高性能。
  • 尽管额定功率为700瓦,该系统仍实现了低于或等于550瓦的持续功耗。

这些改进旨在通过降低成功交付结果的成本并支持代理工作负载的快速迭代,使能力日益增强的AI更加负担得起且广泛可用。