OpenAI推出了GPT-5.6模型系列,旨在通过优化推理开销并引入新的API控制功能,以更低的成本实现前沿级别的智能体性能。此次更新允许初创公司使用Luna和Terra等较小规模的模型处理高吞吐量任务,同时保留较大模型用于复杂判断,从而构建速度更快、能力更强的智能体。
- 在恒定测试条件下,GPT-5.6 Sol在“低”推理设置下的表现优于GPT-5.5在“高”推理设置下的表现,测试基准为Agents’ Last Exam。
- 在BrowseComp基准测试中,GPT-5.6 Luna得分为84.04%,费用为1.33美元;相比之下,GPT-5.5得分为84.36%,费用为33.27美元。
- 新的Responses API原语包括持久化推理、原生压缩、多智能体编排以及编程式工具调用。
- 在ARC-AGI-3上启用保留推理和压缩功能后,GPT-5.6 Sol的得分从13.3%提升至38.3%,同时输出标记数减少了约6倍。
- Prompt缓存TTL延长至至少30分钟,并采用确定性缓存断点,以提高命中率并降低延迟。
这些变化改变了构建智能体的经济模型,通过使用较小规模的模型和高效的架构选择,以极低的成本实现相当或更优的结果。