Anthropic telah merilis Claude Fable 5.1, sebuah pembaruan model yang menetapkan standar baru untuk tugas pemrograman, kerja berbasis pengetahuan, dan pemecahan masalah jangka panjang. Rilis ini menyoroti peningkatan kinerja signifikan pada benchmark Terminal-Bench-Science 0.1 yang baru, di mana Fable 5.1 mencapai skor 52,6%, dibandingkan dengan 24,7% untuk Fable 5, 29,0% untuk Opus 5, dan 22,4% untuk GPT-5.6 Sol.

  • Claude Fable 5.1 memperkenalkan lima tingkat penalaran: rendah, sedang, tinggi, xhigh, dan max, tanpa opsi untuk menonaktifkan penalaran sepenuhnya.
  • Pengujian pada prompt pembuatan SVG pelikan menunjukkan bahwa tingkat usaha rendah dan sedang melewatkan jejak penalaran sepenuhnya, sementara tingkat yang lebih tinggi menghasilkan monolog internal yang mendetail.
  • Tingkat penalaran 'max' memerlukan 65.927 token keluaran dan menelan biaya $3,30 untuk tugas tersebut, menghasilkan output visual paling mendetail di antara model-model yang diuji.
  • Menganimasikan SVG yang dihasilkan menggunakan tingkat berpikir 'high' menghabiskan biaya $1,37 dan menghasilkan video dengan roda berputar, meskipun arahnya salah.

Pembaruan ini memungkinkan pengguna membandingkan kinerja model di berbagai tingkat usaha penalaran, mengungkap bagaimana peningkatan investasi komputasi berdampak pada kualitas dan detail output.