أعلنت OpenAI عن نموذجها الجديد o3، الذي حقق نتيجة بنسبة 25% في معيار Frontier Math، وهو قفزة كبيرة مقارنة بالمتوسط السابق البالغ 2% لنماذج الذكاء الاصطناعي التوليدية. يبرز هذا النتيجة التحسينات السريعة في قدرات الذكاء الاصطناعي على الاستدلال الرياضي.
- يُعد Frontier Math معياراً خاصاً لأسئلة رياضية صعبة مصممة لاختبار القدرات المشابهة للبشر دون الاعتماد على البيانات المحفوظة.
- يستخدم نموذج o3 سلاسل تفكير تكرارية، مما يسمح له بتقييم وتصحيح خطوات استدلاله الخاصة قبل الإجابة.
- يتطلب هذه العملية حسابات كبيرة، حيث تتجاوز تكلفة الإجابة على بعض الأسئلة الفردية 1000 دولار.
- على عكس النماذج المتخصصة مثل AlphaProof من Google DeepMind، فإن o3 هو ذكاء اصطناعي عام يظهر مهارات رياضية متقدمة.
تشير المقالة إلى أنه إذا انخفضت التكاليف وتحسنت النتائج، فقد يقوم رياضيو الذكاء الاصطناعي بتحويل الأساليب الرسمية من خلال أتمتة عمليات التحقق التي تقتصر حالياً على ندرة الخبراء البشريين.