حدّدت OpenAI وأعطلت حملة تنقيص عدائية منسقة تُنسب إلى أفراد مرتبطين بـ Moonshot AI، مطوّر Kimi. قام المشغّلون بالتلاعب بتفاعلات النموذج لاستخراج الاستدلال الداخلي المحمي من نماذج OpenAI، مما ينتهك شروط الخدمة.
- بدأت النشاط في 1 يوليو، وتصاعد إلى ذروات عالية الحجم بلغت 16,000 طلب من أكثر من 4,000 مستخدم في 24 و25 يوليو.
- تم تحديد نشاط مرتبط بأنماط الطلبات عبر مجموعة تضم أكثر من 15,000 مستخدم، وتم تعطيلها بالكامل بحلول 28 يوليو.
- حاول المهاجمون استخراج الاستدلال عن طريق نسخ المحتوى المشفر من محادثة واحدة وطلب نموذج في محادثة أخرى فك تشفيره.
- خفّفت OpenAI من حدة الحملة من خلال إنفاذ الحسابات، والضوابط التقنية، والتنسيق مع Forum النموذجي الحدودي.
تحذر الشركة من أن التنقيص العدائي يشكل مخاطر تتعلق بالسلامة والأمن القومي من خلال السماح للآخرين بإعادة إنتاج قدرات النموذج دون الحفاظ على الضمانات الأصلية.