OpenAI宣布对其GPT-5.6模型大幅降价,这得益于系统性效率提升和递归自我优化技术。该公司报告称,GPT-5.4级别智能的成本在四个月内下降了约13倍,GPT-5.6 Luna的价格削减了80%,Terra的价格削减了20%。

  • OpenAI利用GPT-5.6 Sol自主重写Triton和Gluon中的生产内核,将端到端服务成本降低了20%。
  • 改进的推测解码通过数百次自动化实验,使令牌生成效率提高了15%以上。
  • 智能体工具包优化,包括延迟发现和提示缓存,降低了Codex等工具的重复计算成本。
  • 新的“Sol Fast”层级提供比标准价格高一倍的更低延迟(2.5倍),而下游智能体工作流的成本预计将降低约10倍。

这些变化使OpenAI在非微调智能方面具有极高的成本效益,观察人士指出,3月份的旗舰性能现在只需以前令牌价格的一小部分即可获得。