OpenAI ने Moonshot AI के साथ जुड़े व्यक्तियों द्वारा किए गए समन्वित विरोधाभासी विसंजन (adversarial distillation) अभियान की पहचान की और उसे बाधित किया, जो किमि का डेवलपर है। ऑपरेटरों ने OpenAI मॉडल्स से संरक्षित आंतरिक तर्क निकालने के लिए मॉडल इंटरैक्शन को गड़बड़ किया, जो सेवा की शर्तों का उल्लंघन था।
- गतिविधि 1 जुलाई को शुरू हुई, और 24 और 25 जुलाई को 4,000 से अधिक उपयोगकर्ताओं द्वारा 16,000 अनुरोधों के उच्च-आयतन स्पाइक तक बढ़ गई।
- संबंधित प्रॉम्प्ट-पैटर्न गतिविधि 15,000 से अधिक उपयोगकर्ताओं के क्लस्टर में पहचानी गई, जिसे 28 जुलाई तक पूरी तरह से बाधित कर दिया गया।
- हमलावरों ने एक संवाद से एन्क्रिप्टेड सामग्री को कॉपी करके और दूसरे मॉडल को उसे डिक्रिप्ट करने के लिए कहकर तर्क निकालने का प्रयास किया।
- OpenAI ने अकाउंट लागूकरण, तकनीकी नियंत्रणों और फ्रंटियर मॉडल फोरम के साथ समन्वय के माध्यम से इस अभियान को कमजोर किया।
कंपनी चेतावनी देती है कि विरोधाभासी विसंजन सुरक्षा और राष्ट्रीय सुरक्षा जोखिमों का कारण बनता है, क्योंकि यह मूल सुरक्षा उपायों को बनाए रखे बिना अन्य लोगों को मॉडल क्षमताओं की प्रतिलिपि बनाने की अनुमति देता है।