Anthropic telah memperbarui pengaman biologi Claude Fable 5 untuk secara substansial mengurangi hasil positif palsu, yang mengakibatkan penurunan sekitar 85% dalam fallback terkait biologi di seluruh permukaan produknya. Perubahan ini memungkinkan model untuk membantu dengan berbagai kueri kesehatan dan pendidikan sehari-hari sambil tetap memblokir penelitian profesional penggunaan ganda.
- Pembaruan menulis ulang konstitusi pengklasifikasi keamanan untuk lebih membedakan antara penggunaan yang tidak berbahaya dan konten penggunaan ganda yang berbahaya seperti virologi atau toksikologi.
- Fallback berkurang sekitar 67% di Claude.ai, 55% di Cowork, 17% di Claude Code, dan 7% di Platform Claude.
- Profesional kesehatan akan menerima lebih banyak dukungan pada tugas klinis, meskipun penelitian biologi profesional dan pengembangan obat tetap diblokir.
Perusahaan bertujuan menyeimbangkan risiko bencana dari pengembangan senjata biologis dengan kebutuhan untuk menyediakan kemampuan AI terdepan kepada peneliti yang sah melalui jalur akses tepercaya.