Anthropic mengubah Claude Code sehingga mode Auto menjadi pengaturan default untuk sesi baru pada paket Pro, Max, dan Team mulai 14 Agustus. Perubahan ini mengikuti adopsi internal di Anthropic dan data evaluasi baru yang menunjukkan peningkatan keamanan terhadap injeksi prompt.
- Sebuah studi dari 1.053 penguji berbayar menemukan bahwa sementara hanya 13,6% manusia menolak perintah berbahaya, mode Auto akan memblokir 89% tindakan tersebut.
- Evaluasi independen oleh Trajectory Labs menguji 720 skenario injeksi prompt tidak langsung terhadap Claude Fable 5, Opus 5, dan Sonnet 5 yang menjalankan mode Auto.
Tidak satu pun dari 720 upaya serangan berhasil melawan model Claude yang ditentukan selama pengujian pihak ketiga.
Perubahan ini bertujuan untuk mengurangi kelelahan konfirmasi dan mengurangi risiko injeksi prompt dan eksfiltrasi data dengan mengandalkan pemeriksaan izin otomatis daripada persetujuan manusia.