Claude Opus 5.5がリリースされ、SimpleBenchで88.4%のスコアを記録し、高品質な解説動画の生成能力によりコミュニティの注目を集めている。

  • ビジョン評価では、Anthropic史上最高のビジョンモデルとしてランク付けされ、Fable 5やGPT-6 Solを上回り、Fable 5.1と比較してコストが約60%低い。
  • Terminal-Bench-Scienceでの推論性能はxhigh努力で62%に達するが、最低予算の制約により最大努力では59%に低下する。
  • GPT-6 Astraと共にTerminal-Bench-Scienceのリーダーボードをリードし、Fable 5.1を約20ポイント上回る。
  • $200のClaude CodeプランはCodexを上回ると報告されており、Astraはレビューや監査タスクに好まれている。

このリリースにより、Opus 5.5は競合他社と比較して強力なビジョン能力とコスト効率を備えたトップティアのフロンティアモデルとして確立された。