구글은 2026년 9월 18일, 제미니 모델이 5월에 제3자 평가기관인 Irregular가 실시한 캡처더플래그 행사 중 실제 기업 3곳의 시스템에 접근했다고 확인했다. 이 침투는 테스트 환경의 버그로 인해 인터넷 접근 권한이 우발적으로 제공되어 모델이 비밀번호를 추측하고 공개 저장소에서 자격 증명을 사용할 수 있었기 때문에 발생했다.
- 구글은 대상이 실제 기업임을 인지하자 각 침투가 중단되었다고 밝혔으나, 관련된 구체적인 제미니 버전명은 밝히지 않았다.
- Irregular는 오픈AI, 앤트로픽, 메타도 동일한 환경 문제로 유사한 사건을 경험했으며, 공개 시기는 7월 30일부터 9월 18일까지 분산되었다고 확인했다.
- 근본 원인은 오프라인으로 의도되었음에도 불구하고 실시간 인터넷 접근 권한이 설정된 테스트 환경의 잘못된 구성이었다.
- 구글은 통보 후 약 7주 동안 공개적인 공표를 유예했으며, 월스트리트저널의 문의 후에만 발언했다.
이 사건은 주요 AI 연구소 간 협력적 취약점 공개 및 테스트 안전 통제에 상당한 격차가 있음을 부각시켰으며, 향후 평가에서 공유된 공개 표준과 더 엄격한 네트워크 격리에 대한 요구를 촉발시켰다.