أطلقت إنفيديا Alpamayo 2 Super، وهو نموذج رؤية-لغة-فعل (VLA) بـ34 مليار معلمة مصمم لتاكسيات الروبوت والقيادة الذاتية بموجب ترخيص OpenMDW-1.1. يستهدف النموذج الأحداث ذات الذيل الطويل من خلال دمج العمود الفقري Cosmos 3 Super Reasoner المكون من 32 مليار معلمة مع فاعل انتشار مبني على الانتشار بحجم 2.3 مليار معلمة لتوليد المسارات، والتفسيرات السببية، والإجراءات الوصفية من مقاطع الفيديو متعددة الكاميرات.

  • يحتل Alpamayo 2 Super المرتبة الأولى في LingoQA بنتيجة Lingo-Judge تبلغ 79.2، متفوقاً على Qwen2.5-VL 72B وGemini 2.5 Pro وGPT-4o.
  • تم تدريب النموذج على حوالي 115,000 ساعة من مقاطع فيديو القيادة وأكثر من مليار صورة، بما في ذلك 3.7 مليون أثر لـ Chain-of-Causation.
  • ينتج خمسة مخرجات من تمرير واحد: المسار، أثر CoC، الإجراء الوصفي، التسميات الذاتية للاستدلال، والإجابة على الأسئلة البصرية مع التأريض ثنائي الأبعاد.
  • حققت التقييمات ذات الحلقة المغلقة على AlpaSim نتيجة 1.50 ± 0.13، بينما حقق الاختبار ذو الحلقة المفتوحة قيمة minADE₆ تبلغ 0.911 متر عند 6.4 ثانية.

يسمح الإطلاق بالاستخدام التجاري وإعادة التوزيع دون إذن إضافي، وتذكر إنفيديا أن النموذج يمكنه ضغط دورات التسمية من أشهر إلى أيام عند استخدامه كمُعلّم ذاتي لبيانات الأسطول الخاصة.