يُعد Shieldstral مصنف أمان متعدد الوسائط مفتوح الأوزان بحجم 3 مليار معلمة، يصوّر وسيط المحتوى كمهمة إجابة على أسئلة تتكيف مع السياسات، مما يتيح له قبول سياسات بلغة طبيعية أثناء الاستدلال دون الحاجة إلى إعادة التدريب. يُوحد تقييم أمان النصوص والصور ويقدّم درجات أمان معايرة عبر معايير متنوعة بينما يعمل بكفاءة على بطاقة NVIDIA GPU واحدة بسعة 16GB.

  • يتفوق على نماذج السياج الواقي حتى بحجم أكبر بـ7 مرات في أمان النصوص، ويحقق حالة فنية جديدة في وسيط متعدد الوسائط.
  • يقبل سياسات بلغة طبيعية حرة الصياغة أثناء الاستدلال، مما يتيح التكيف مع سياقات جديدة دون إعادة التدريب.
  • يُرجع درجة أمان مستمرة ومعايرة عبر تطبيع softmax للقيم اللوغيتية (logits) بنعم/لا من تمرير أمامي واحد.
  • تم تدريبه على مصادر بيانات غير متجانسة مُوحّدة في صيغة تعليمات-استعلام-وثيقة مع أزواج تناظرية مقصودة لتعليم التمييز.

تتيح هذه النهج للمطورين تعديل تعريفات الأمان ديناميكياً بناءً على سياق المنتج والجمهور، مما يتجنب الحاجة إلى تصنيفات أضرار ثابتة مُدمجة في أوزان النموذج.