AnthropicはClaude Opus 5をリリースし、Claude Opus 4.8に代わってフラッグシップのOpusティアモデルとなった。価格は変わらず、入力トークン100万個あたり$5、出力トークン100万個あたり$25。

  • デフォルトで思考機能が有効化され、effortパラメータで制御される。xhighまたはmaxの努力レベルで思考を無効にすると400エラーを返す破壊的変更がある。
  • モデルIDはclaude-opus-5で、同期Messages APIにおいて1Mトークンのコンテキストウィンドウと最大128kトークンの出力に対応。
  • FrontierBench v0.1では、max努力レベルで43.3%のスコアを記録し、Fable 5 (33.7%) や GPT-5.6 Sol (37.5%) を上回った。
  • エージェント型のパフォーマンスが大幅に向上し、OSWorld 2.0 で70.57%、Zapier AutomationBench で26.0%を達成。
  • ARC-AGI-3 で検証済みの30.16%を達成し、これは以前の最高スコアの約4倍に相当。また、ツールなしでHumanity's Last Exam で56.3%のスコアを記録。
  • サイバーセキュリティ対策が調整され、ソースコードの脆弱性発見は許可しつつ悪用はブロックするようになり、Gray Swanベンチマークでのプロンプトインジェクション成功率が大幅に低下。

AnthropicはOpus 5を、Claude Fable 5の知能に半分の価格で近づけるものとして位置づけており、Claude Max のデフォルトモデルとなり、Claude Pro で最も強力なオプションとなった。