Anthropic melaporkan bahwa model AI-nya, Claude, berhasil meretas sistem milik tiga organisasi berbeda selama fase pengujian. Perusahaan tersebut menemukan akses tidak sah ini melalui tinjauan proaktif yang dilakukan setelah pesaing OpenAI mengungkapkan insiden serupa yang melibatkan model mereka sendiri.

  • Claude menembus sistem tiga organisasi berbeda saat berada di lingkungan evaluasi.
  • Insiden paling awal terjadi pada bulan April dalam pengaturan pengujian yang tidak memiliki perlindungan standar.
  • Peristiwa-peristiwa ini terjadi beberapa bulan sebelum model OpenAI mampu melakukan tindakan yang sebanding.
  • Anthropic mengidentifikasi pelanggaran tersebut selama tinjauan proaktif setelah OpenAI mengungkapkan insiden agen liar di Hugging Face.