Google telah membuka sumber Mantis, sebuah toolkit keterampilan tinjauan keamanan yang agnostik terhadap tumpukan, yang memungkinkan agen pemrograman AI menjalankan seluruh siklus kerentanan. Sistem ini memungkinkan agen untuk mengidentifikasi cacat yang dicurigai, menghilangkan hasil positif palsu, mereproduksi bug dalam sandbox, menulis tambalan minimal, menyerang ulang tambalan tersebut, dan menilai risiko sisa.

Mantis beroperasi sebagai serangkaian perintah slash untuk agen pemrograman yang ada alih-alih pemindai mandiri, dengan merangkai keterampilan berurutan melalui agen pengawas. Tahapan kunci meliputi penambangan riwayat kontrol versi, membangun model ancaman, menyapu file terhadap rencana, dan menggabungkan duplikat. Pipelina berakhir dengan reproduksi dalam sandbox menggunakan gVisor atau VM, menyusun rantai eksploitasi, menerapkan perbaikan, dan menghasilkan paket tinjauan yang mudah dibaca manusia.

Toolkit ini mengatasi masalah tingkat true-positive di bawah 7 persen pada pemindaian kode AI naif dengan mendasarkan kepercayaan pada reproduksi dalam sandbox dan serangan ulang tambalan alih-alih kepercayaan model. Google melaporkan bahwa pohon ringkasan hierarkisnya mengurangi overhead token lebih dari 85 persen. Meskipun dapat diterapkan secara lokal di bawah lisensi Apache 2.0 untuk evaluasi, toolkit ini belum direkomendasikan untuk penggunaan produksi.