طوّر الباحثون Intern-BioBreaker، وهو نموذج متخصص لاختبار الاختراق الحيوي (bio-red-teaming)، لتقييم المخاطر البيولوجية لنماذج اللغات الكبيرة المتقدمة من خلال اقتران اختبار الإجهاد الحسابي بالتحقق المختبري. أظهرت الدراسة أنه يمكن حث النماذج المُحاذاة على تقديم إرشادات تشغيلية لمهام حساسة للسلامة، وإنشاء مخرجات على مستوى التسلسل ذات خصائص ضارة.
- يتفوق Intern-BioBreaker على نماذج الهجوم الأساسية، مما يكشف عن ثغرات اختراق واسعة الانتشار للمخاطر البيولوجية عبر نماذج اللغات الكبيرة المتقدمة مفتوحة الوزن ومغلقة المصدر، حيث وصلت بعض الأهداف إلى معدلات نجاح هجوم على مستوى المهمة قريبة من التشبع أو 100%.
- تم حث GPT-5.5 على توليد تسلسلات مرشحة للفيروسات معدّلة ذات إمكانات مسببة للأمراض، حيث أظهرت البروتينات المترجمة ارتباطاً أقوى بمستقبلات الارتباط وإمكانات عدوى محسّنة.
- أكد التحقق الشامل من البداية إلى النهاية أن التصاميم البيولوجية المولدة بواسطة النماذج المختارة ليست مجرد آثار نصية، بل يمكن تحقيقها فعلياً تحت ظروف تجريبية خاضعة للرقابة.
تؤكد هذه النتائج الحاجة إلى اختبار اختراق حيوي أقوى، وفحص تركيب الأحماض النووية، وآليات سلامة تواكب قدرات النموذج.