OpenAI 为 GPT-6 系列推出了改进的提示缓存系统,默认情况下提供更高的缓存命中率,并对缓存输入令牌提供高达 90% 的折扣。此次更新引入了新工具,帮助开发者监控性能、诊断未命中情况并优化其集成。

  • 在 30 分钟窗口内重用的符合条件的共享前缀现在可享受缓存折扣。
  • Prompt Caching Dashboard 允许跟踪随时间变化的命中率,并比较缓存与未缓存的令牌。
  • 诊断工具有助于识别导致缓存未命中的原因,例如工具或设置的更改。
  • 显式缓存断点让开发者可以选择特定的提示前缀进行重用。
  • 通过配置更新,可以在响应之间调整推理力度,而不会破坏缓存。
  • 预热功能允许提前准备已知上下文,以降低延迟。

这些功能通过最大化跨 API 请求的共享指令、工具定义和上下文的复用,帮助持久化代理运行得更快且成本更低。