Cogent AI telah merilis VR-1, sebuah model penalaran yang dipost-training secara khusus untuk keamanan siber guna menyusun dan memverifikasi jalur serangan perusahaan. Rilis ini mencakup IntrusionBench, sebuah benchmark yang menilai agen berdasarkan intrusi yang berhasil diselesaikan, serta Cogent AI Harness, runtime terkelola untuk agen keamanan.

  • VR-1 hanya tersedia bagi organisasi terverifikasi melalui Program Akses Frontier Cogent dengan guardrails dan pencatatan audit.
  • Model ini menyelidiki lingkungan, menguji hipotesis, dan mengeksekusi rantai di konteks cloud, identitas, dan CI/CD dengan batas dua jam atau 250 putaran.
  • IntrusionBench menilai eksekusi bukan narasi, menggunakan pengaturan informasi black-box, grey-box, dan white-box.
  • Cogent melaporkan VR-1 membuktikan sekitar dua kali lipat jalur serangan dengan biaya sekitar seperempat dibandingkan Kimi K3, Claude Opus 4.8, dan GLM-5.2 dalam uji pass@3 black-box.
  • Tingkat keberhasilan black-box model ini sendiri berada di bawah 30%, dan Cogent menyebut angka-angka tersebut sebagai prakiraan awal.

Cogent mengutip pelarian sandbox AI terbaru sebagai alasan mengapa pembela membutuhkan kemampuan penalaran setara, memposisikan VR-1 untuk perusahaan besar dengan kebutuhan keamanan yang kompleks.