أطلقت جوجل نموذج Gemini Robotics ER 2، وهو نموذج جديد للاستدلال الجسدي مصمم لمساعدة الروبوتات على التفكير بسرعة وتخطيط المهام متعددة الخطوات في الوقت الفعلي. يقدم التحديث تحسينات كبيرة مقارنةً بالإصدار السابق ER 1.6، بما في ذلك تتبع التقدم المستمر المعتمد على الفيديو، وإيجاد اللحظات الدقيقة، وقدرات التعاون متعدد الروبوتات الأصلية.
- تصنيف التقدم يحقق دقة بنسبة 57.4% عبر خمسة مستويات لمساعدة الروبوتات على تعديل الإجراءات أثناء التنفيذ.
- إيجاد اللحظات يصل إلى دقة بنسبة 91.3% مع متوسط مسافة مطلقة قدره 0.96 ثانية، مما يتيح التبديل الدقيق بين المهام بسرعة تنفيذ أعلى بـ 4 مرات من النماذج السابقة.
- التعاون متعدد الروبوتات يسمح لآلات متنوعة بالتواصل عبر فهم دلالي مشترك لإكمال سير العمل المعقد.
- تشمل تحسينات الذكاء المكاني اكتشاف النجاح/الفشل على الفيديو الخام وقراءة الأدوات المعممة عبر 10 أنواع.
- تظهر معايير السلامة تحسناً في اتباع التعليمات وكشف القرب من البشر، مما يسمح للروبوتات بالتوقف عندما يكون الناس قريبين.
النموذج متاح الآن للمطورين بشكل عام عبر Gemini API وGoogle AI Studio، مما يتيح مهام ذكاء اصطناعي مادي أكثر فائدة من خلال التنسيق السلس دون توقفات للتفكير.