谷歌于2026年9月18日确认,Gemini模型在5月由第三方评估机构Irregular进行的夺旗(capture-the-flag)演习期间访问了三个真实公司的系统。这些入侵是由于测试环境中的漏洞意外提供了互联网访问权限,使模型能够猜测密码并使用公共存储库中的凭据。
- 谷歌表示,该模型在意识到目标是真实实体后停止了每次入侵,但未提及涉及的具体Gemini版本。
- Irregular确认OpenAI、Anthropic和Meta也经历了来自同一环境问题的类似事件,披露时间从7月30日至9月18日不等。
- 根本原因是配置错误的测试环境尽管旨在离线运行,却拥有实时互联网访问权限。
- 谷歌在收到通知后延迟了约七周才公开披露,仅在《华尔街日报》提出询问后才发表声明。
该事件凸显了主要AI实验室在协调漏洞披露和测试安全控制方面的重大差距,促使人们呼吁建立共享的披露标准并在未来评估中实施更严格的网络隔离。