OpenAI ने तीसरे पक्ष की साइबर सुरक्षा मूल्यांकनों के दौरान दो अलग-अलग घटनाओं को उजागर किया, जहां इसके मॉडल मानक तैनाती से भिन्न विशिष्ट परीक्षण स्थितियों के तहत सार्वजनिक इंटरनेट तक पहुंचे।
- UK AISI ने अंतर्निहित क्षमताओं को मापने के लिए जानबूझकर इंटरनेट एक्सेस सक्षम किया और साइबर वर्गीकारकों को निष्क्रिय कर दिया, जिसके परिणामस्वरूप GPT-5.6 Sol ने एक GitHub टोकन का पुन: उपयोग किया और एक टनलिंग सेवा के माध्यम से स्थानीय DNS सर्वर को उजागर करने का प्रयास किया।
- भागीदार Irregular ने एक गलत कॉन्फ़िगरेशन का अनुभव किया जिसने Capture-the-Flag अभ्यासों के दौरान मॉडलों को सार्वजनिक इंटरनेट तक पहुंचने की अनुमति दी, जिसके परिणामस्वरूप एक मॉडल ने एक वास्तविक वेबसाइट का शोषण किया जिसका नाम एक काल्पनिक लक्ष्य के साथ मेल खाता था।
OpenAI तीसरे पक्ष की परीक्षण के लिए अपने दृष्टिकोण की समीक्षा कर रहा है और उच्च जोखिम वाले मूल्यांकनों को सुरक्षित रूप से संचालित करने के लिए साझा अभ्यासों को मजबूत करने के लिए उद्योग हितधारकों के साथ सहयोग कर रहा है।