أطلقت جوجل أول تقييم عمى مزدوج في العالم لنموذج ذكاء اصطناعي خاص من الفئة المتقدمة بالشراكة مع معهد سلامة الذكاء الاصطناعي في سنغافورة، وOpenMined، وAVERI، وMLCommons. تختبر النسخة التجريبية نموذج Gemini Flash Lite ضد معايير مرجعية سرية ضمن بيئة تحافظ على الخصوصية لمنع تلوث المعايير المرجعية.
تستخدم المبادرة Google Cloud’s Confidential Space للتحقق تشفيرياً من أن بيانات التقييم الخارجية وأوزان النموذج الخاص تبقى خاصة بمالكيها على التوالي. يلغي هذا النهج المقايضة التاريخية بين كشف أوامر الاختبار أو مشاركة أوزان النموذج، مما يضمن عدم قدرة أي من الطرفين على الوصول إلى المعلومات الحساسة للطرف الآخر أثناء الاختبار.
من خلال منع النماذج من الاطلاع على أسئلة التقييم مسبقاً، تهدف هذه الطريقة إلى زيادة نزاهة التقييم وتوفير مقاييس موثوقة لصناع السياسات والشركات حول القدرات الحقيقية للنموذج وسلامته.