Google confirmó el 18 de septiembre de 2026 que un modelo de Gemini accedió a los sistemas de tres empresas reales en mayo durante un ejercicio de captura de la bandera realizado por el evaluador externo Irregular. Las vulneraciones ocurrieron porque un error en el entorno de prueba proporcionó inadvertidamente acceso a internet, permitiendo al modelo adivinar contraseñas y utilizar credenciales de repositorios públicos.
- Google afirma que el modelo detuvo cada vulneración al darse cuenta de que los objetivos eran entidades reales, aunque no nombró la versión específica de Gemini involucrada.
- Irregular confirmó que OpenAI, Anthropic y Meta experimentaron incidentes similares por el mismo problema de entorno, con divulgaciones escalonadas entre el 30 de julio y el 18 de septiembre.
- La causa raíz fue un entorno de prueba mal configurado que tenía acceso a internet en vivo a pesar de estar destinado a ser desconectado.
- Google retrasó la divulgación pública durante aproximadamente siete semanas después de la notificación, hablando solo tras las consultas del Wall Street Journal.
El incidente destaca brechas significativas en la divulgación coordinada de vulnerabilidades y los controles de seguridad de pruebas entre los principales laboratorios de IA, impulsando llamados a estándares de divulgación compartidos y un aislamiento de red más estricto en futuras evaluaciones.