Anthropic telah merilis Claude Opus 5, menggantikan Claude Opus 4.8 sebagai model unggulan tier Opus sambil mempertahankan harga yang tidak berubah yaitu $5 per juta token input dan $25 per juta token output.

  • Pemikiran kini diaktifkan secara default, dikendalikan oleh parameter effort, dengan perubahan pemutus yang mengembalikan error 400 jika pemikiran dinonaktifkan pada level xhigh atau max effort.
  • ID model adalah claude-opus-5, dilengkapi jendela konteks 1M-token dan output maksimum 128k token pada Messages API sinkron.
  • Pada FrontierBench v0.1, Opus 5 mencetak skor 43.3% di max effort, mengungguli Fable 5 (33.7%) dan GPT-5.6 Sol (37.5%).
  • Kinerja agentic mengalami lonjakan signifikan, mencapai 70.57% pada OSWorld 2.0 dan 26.0% pada Zapier AutomationBench.
  • Opus 5 mencapai skor terverifikasi 30.16% pada ARC-AGI-3, sekitar empat kali lipat dari skor terbaik sebelumnya, dan mencetak 56.3% pada Humanity's Last Exam tanpa alat.
  • Pengaman siber disesuaikan untuk memungkinkan penemuan kerentanan kode sumber sambil menghalangi eksploitasi, dengan tingkat keberhasilan injeksi prompt turun secara signifikan pada benchmark Gray Swan.

Anthropic memposisikan Opus 5 sebagai model yang mendekati kecerdasan Claude Fable 5 dengan separuh harga, menjadikannya model default di Claude Max dan opsi terkuat di Claude Pro.