حقق نظام o3 الجديد من OpenAI، المدرب على مجموعة التدريب العامة ARC-AGI-1، نتيجة 75.7٪ على مجموعة التقييم شبه الخاصة ضمن حد حسابي قدره 10 آلاف دولار و87.5٪ مع تكوين عالي الحساب.
- تأهل النتيجة عالية الكفاءة للمركز الأول في لوحة المتصدرين العامة وفقًا لقواعد ARC-AGI-Pub.
- أُجريت الاختبارات على مستويين للحساب: عينة واحدة لكل من الكفاءة العالية (6 عينات) والكفاءة المنخفضة (1024 عينة، أي 172 ضعفًا من الحساب).
- أكدت OpenAI أن النسخة المختبرة تختلف عن النسخة o3 الصادرة رسميًا، مع تحديث النتائج لاحقًا.
ترى جائزة ARC في ذلك قفزة كبيرة في قدرات الذكاء الاصطناعي، مما يوضح قدرات تكيف جديدة مع المهام لم تُرَ في نماذج عائلة GPT السابقة.