أطلقت مؤسسة جائزة ARC معيار ARC-AGI-2، وهو معيار جديد مصمم لقياس الذكاء المرن من خلال تقديم مهام سهلة على البشر ولكن صعبة على أنظمة الذكاء الاصطناعي الحالية. إلى جانب المعيار، أعلنت المؤسسة عن مسابقة جائزة ARC 2025 لدفع التقدم في المصادر المفتوحة نحو ذكاء عام كفؤ.

يرفع ARC-AGI-2 مستوى الصعوبة بشكل ملحوظ مقارنة بسلفه، حيث سجلت نماذج اللغات الكبيرة (LLMs) الخالصة نسبة 0%، وحقق أنظمة الاستدلال العامة نسبًا فردية فقط. يتكون المعيار من 120 مهمة لكل مجموعة تقييم (زيادة من 100)، وتتطلب تفسيرًا رمزيًا، واستدلالًا تركيبياً، وتطبيق قواعد سياقية. حل المشاركون البشر كل المهام في محاولتين أو أقل، مما يسلط الضوء على الفجوة بين مرونة البشر وقدرات الذكاء الاصطناعي الحالية.

تهدف المبادرة إلى أن تكون نجمة الشمال لأبحاث الذكاء العام (AGI) من خلال التركيز على فجوات القدرات التي لا تنشأ عن التوسع في الحجم، مما يلهم الباحثين لتطوير أفكار جديدة للذكاء العام.