OpenAI推出了迄今为止最智能的模型GPT-6 Astra,并概述了其全栈计算策略,其中包括全新的Jalapeño推理芯片。该公司报告称,在InferenceX测试中,其定制硬件每瓦特峰值令牌吞吐量比商用系统高出1.5至1.9倍。

  • GPT-6 Astra被描述为在计算机使用、浏览、软件工程、网络安全、科学和专业工作方面处于最先进水平。
  • 与已测试的商用系统相比,Jalapeño推理芯片将端到端延迟降低了1.7至3.6倍。
  • GPT-5.6 Sol改进了生产服务软件,将端到端服务成本降低了20%,并将令牌生成效率提高了15%以上。
  • OpenAI的研究组织现在每投入一个人工工作日的工作量,就使用3.1个代理工作日的努力。

这些进步旨在降低AI任务的成本并提高速度,使客户能够以更少的尝试取得更多成果,同时通过多元化的收入流支持OpenAI的增长。