Anthropic已发布Claude Opus 5,取代Claude Opus 4.8成为旗舰级Opus模型,同时保持价格不变:每百万输入token为5美元,每百万输出token为25美元。

  • 思考功能现已默认启用,由effort参数控制;存在一项破坏性变更:若在xhigh或max effort级别禁用思考,将返回400错误。
  • 模型ID为claude-opus-5,支持1M token上下文窗口,在同步Messages API上最大输出为128k tokens。
  • 在FrontierBench v0.1上,Opus 5在max effort下得分43.3%,优于Fable 5(33.7%)和GPT-5.6 Sol(37.5%)。
  • 智能体性能显著提升:在OSWorld 2.0上达到70.57%,在Zapier AutomationBench上达到26.0%。
  • Opus 5在ARC-AGI-3上获得验证得分30.16%,约为此前最佳分数的四倍;在无工具条件下于Humanity's Last Exam中得分为56.3%。
  • 安全护栏已调整,允许发现源代码漏洞同时阻止利用行为,在Gray Swan基准测试中提示注入成功率显著下降。

Anthropic将Opus 5定位为以一半价格接近Claude Fable 5的智能水平,使其成为Claude Max的默认模型,也是Claude Pro中最强的选项。