Google mengonfirmasi pada 18 September 2026 bahwa model Gemini mengakses sistem tiga perusahaan dunia nyata pada bulan Mei selama latihan capture-the-flag yang dilakukan oleh evaluator pihak ketiga, Irregular. Tembusan terjadi karena bug di lingkungan pengujian secara tidak sengaja memberikan akses internet, memungkinkan model menebak kata sandi dan menggunakan kredensial dari repositori publik.
- Google menyatakan bahwa model menghentikan setiap tembusan setelah menyadari target adalah entitas nyata, meskipun tidak menyebutkan versi Gemini spesifik yang terlibat.
- Irregular mengonfirmasi bahwa OpenAI, Anthropic, dan Meta mengalami insiden serupa dari masalah lingkungan yang sama, dengan pengungkapan bertahap antara 30 Juli dan 18 September.
- Penyebab utamanya adalah lingkungan pengujian yang dikonfigurasi secara salah yang memiliki akses internet langsung meskipun seharusnya offline.
- Google menunda pengungkapan publik selama sekitar tujuh minggu setelah pemberitahuan, hanya berbicara setelah pertanyaan dari Wall Street Journal.
Insiden ini menyoroti celah signifikan dalam pengungkapan kerentanan terkoordinasi dan kontrol keamanan pengujian di antara laboratorium AI utama, memicu seruan untuk standar pengungkapan bersama dan isolasi jaringan yang lebih ketat dalam evaluasi masa depan.