أطلقت شركة Generalist AI نموذج GEN-1.5، وهو نموذج أساسي للروبوت يركز على البحث وقادر على تعلم مهام جديدة في التلاعب المادي من خلال عرض تجريبي واحد مدته 3–12 ثانية عبر نافذة سياق مدتها 30 ثانية. وقد نشأت هذه القدرة، التي تُسمى "التوجيه المادي" (physical prompting)، بشكل عفوي من أكثر من ثمانية أشهر من التدريب المسبق المستمر على بيانات التفاعل المادي بدلاً من أن تكون مصممة صراحةً.

  • حقق التوجيه السياحي أحادي العينة (One-shot in-context prompting) معدل نجاح متوسط يبلغ 59% عبر 10 مهام متنوعة دون أي تحديثات للتدرج أو ضبط دقيق.
  • أدى تطبيق عشر خطوات تدرج على خمس دقائق من البيانات لكل مهمة إلى رفع معدل النجاح إلى 83%، مع تغييرات في الأوزان أقل من 0.15%.
  • أظهر النموذج تعميلاً تركيبياً، ونقلاً من المحاكاة إلى الواقع دون تدريب (zero-shot sim-to-real transfer)، وقدرات على تقليد الإنسان للروبوت لم يتم تدريبها صراحةً.

يُعد هذا الإطلاق إشارة بحثية تتعلق بتوسع التوجيه المادي، رغم أنه ليس قابلاً للنشر بعد لعدم توفر أوزان عامة أو واجهة برمجة تطبيقات (API) أو منتج ذاتي الخدمة.