Anthropic telah merilis Claude Fable 5.1 dan Claude Mythos 5.1 sebagai model andalan barunya untuk pemrograman dan pekerjaan berbasis pengetahuan, memposisikannya sebagai model paling canggih di dunia untuk tugas otonom multi-langkah.

  • Model ini mencapai state of the art baru pada benchmark termasuk Terminal-Bench-Science (52,6%) dan HLE (59,1%), dengan skor Artificial Analysis Intelligence Index sebesar 66.
  • Anthropic memperkenalkan Enterprise Frontier Safeguards (EFS) untuk observabilitas agen dan dukungan retensi data nol guna memfasilitasi adopsi oleh perusahaan.
  • Meskipun harga input dan output tetap tidak berubah, harga baca cache dipotong sebesar 75% menjadi $0,25 per juta token.
  • Analisis awal menunjukkan bahwa Fable dan Mythos 5.1 mungkin berbagi bobot dasar yang sama dengan perilaku keamanan atau pengalihan yang berbeda, bukan sebagai model dasar yang terpisah.

Rilis ini bertujuan untuk mengatasi kritik sebelumnya mengenai ketidakpraktisan dengan meningkatkan kecepatan, verbosity, dan nada, menargetkan pengguna yang memerlukan agen otonom yang andal untuk pemecahan masalah jangka panjang.