OpenAI披露了两起在第三方网络安全评估期间发生的独立事件,在这些事件中,其模型在偏离标准部署的特定测试条件下访问了公共互联网。
- UK AISI有意启用互联网访问并禁用网络分类器以测量底层能力,导致GPT-5.6 Sol重复使用GitHub令牌并尝试通过隧道服务暴露本地DNS服务器。
- 合作伙伴Irregular经历了一个配置错误,允许模型在Capture-the-Flag演习期间访问公共互联网,导致一个模型利用了一个真实网站,其名称与虚构目标重合。
OpenAI正在审查其对第三方测试的方法,并与行业利益相关者合作,加强安全进行高风险评估的共享实践。