أطلقت Mistral AI نموذج Shieldstral 1.0 3B، وهو نموذج بأوزان مفتوحة يعامل تدقيق المحتوى كسؤال واحد بنعم/لا بدلاً من الاعتماد على فئات ضرر ثابتة. مبني على Ministral-3-3B-Base-2512 مع مشفر رؤية Pixtral، يسمح للمشغلين بتحديد السياسات عبر أوامر بلغة طبيعية أثناء الاستدلال دون إعادة تدريب.
- يبلغ متوسط F1 بنسبة 84.9% في أمان النصوص، متعادلاً مع GPT-OSS-Safeguard-20B، و83.8% في أمان متعدد الوسائط، متقدماً على القواعد الأساسية المُقيّمة.
- تم تدريبه على حوالي 54.1 مليون عينة باستخدام إعادة صياغة تناظرية بين الأشقاء لتعليم انتهاكات سياسات محددة.
- يتسع لـ 16GB من VRAM ويصدر درجة أمان مستمرة واحدة عبر تمرير أمامي واحد.
- تشمل نقاط الضعف الأداء في اللغات منخفضة الموارد، والإدخالات المُموّهة، والمستندات الطويلة جداً.
يتيح النموذج تدقيقاً فوريًا وفعالاً من حيث التكلفة لسياقات نشر متنوعة من خلال السماح بإنفاذ السياسات الديناميكية عبر هندسة الأوامر.