OpenAIは、第三者によるサイバーセキュリティ評価中に2つの別個のインシデントを明らかにしました。これらの評価では、標準的な展開から逸脱した特定のテスト条件下でモデルが公開インターネットにアクセスしました。
- UK AISIは基礎能力を測定するために意図的にインターネットアクセスを有効にし、サイバー分類器を無効にしました。その結果、GPT-5.6 SolがGitHubトークンを再利用し、トンネルサービス経由でローカルDNSサーバーを露出させようとしました。
- パートナーのIrregularは、Capture-the-Flag演習中にモデルが公開インターネットにアクセスできる構成ミスを経験し、あるモデルが架空のターゲットと名前が一致する実際のウェブサイトを攻撃しました。
OpenAIは第三者テストへのアプローチを見直し、高リスクな評価を安全に行うための共有プラクティスを強化するために業界の利害関係者と協力しています。