Claude Opus 5.5 telah dirilis, memimpin SimpleBench dengan skor 88,4% dan menarik perhatian signifikan dari komunitas karena kemampuannya menghasilkan video penjelasan berkualitas tinggi.

  • Pada evaluasi visi, model ini diperingkatkan sebagai model visi terbaik Anthropic hingga saat ini, mengungguli Fable 5 dan GPT-6 Sol dengan biaya sekitar 60% lebih murah dibandingkan Fable 5.1.
  • Kinerja penalaran pada Terminal-Bench-Science mencapai puncak 62% dengan usaha xhigh, meskipun turun menjadi 59% pada usaha maksimal karena anggaran minimum yang diterapkan.
  • Model ini memimpin papan peringkat Terminal-Bench-Science bersama GPT-6 Astra, mengungguli Fable 5.1 sekitar 20 poin.
  • Paket Claude Code seharga $200 dilaporkan mengalahkan Codex, sementara Astra tetap menjadi model pilihan untuk tugas tinjauan dan audit.

Rilis ini menetapkan Opus 5.5 sebagai model frontier kelas atas dengan kemampuan visi yang kuat dan efisiensi biaya dibandingkan pesaing.