Anthropic telah merilis Claude Opus 5, menggantikan Claude Opus 4.8 sebagai model unggulan tier Opus sambil mempertahankan harga yang tidak berubah yaitu $5 per juta token input dan $25 per juta token output.
- Pemikiran kini diaktifkan secara default, dikendalikan oleh parameter effort, dengan perubahan pemutus yang mengembalikan error 400 jika pemikiran dinonaktifkan pada level xhigh atau max effort.
- ID model adalah claude-opus-5, dilengkapi jendela konteks 1M-token dan output maksimum 128k token pada Messages API sinkron.
- Pada FrontierBench v0.1, Opus 5 mencetak skor 43.3% di max effort, mengungguli Fable 5 (33.7%) dan GPT-5.6 Sol (37.5%).
- Kinerja agentic mengalami lonjakan signifikan, mencapai 70.57% pada OSWorld 2.0 dan 26.0% pada Zapier AutomationBench.
- Opus 5 mencapai skor terverifikasi 30.16% pada ARC-AGI-3, sekitar empat kali lipat dari skor terbaik sebelumnya, dan mencetak 56.3% pada Humanity's Last Exam tanpa alat.
- Pengaman siber disesuaikan untuk memungkinkan penemuan kerentanan kode sumber sambil menghalangi eksploitasi, dengan tingkat keberhasilan injeksi prompt turun secara signifikan pada benchmark Gray Swan.
Anthropic memposisikan Opus 5 sebagai model yang mendekati kecerdasan Claude Fable 5 dengan separuh harga, menjadikannya model default di Claude Max dan opsi terkuat di Claude Pro.