OpenAI ने अपने नए o3 मॉडल की घोषणा की, जिसने जनरेटिव AI के लिए पिछले 2% के औसत से एक महत्वपूर्ण छलांग लगाते हुए Frontier Math बेंचमार्क पर 25% स्कोर हासिल किया। यह परिणाम AI की गणितीय तर्कशक्ति में तेज़ सुधार को उजागर करता है।
- Frontier Math चुनौतीपूर्ण गणितीय प्रश्नों का एक निजी बेंचमार्क है, जो याद किए गए डेटा पर निर्भर करने के बिना मानव-समान क्षमताओं की जांच करने के लिए डिज़ाइन किया गया है।
- o3 मॉडल पुनरावृत्ति चिंतन श्रृंखला का उपयोग करता है, जिससे यह उत्तर देने से पहले अपने तर्क के चरणों का मूल्यांकन और सुधार कर सकता है।
- इस प्रक्रिया में महत्वपूर्ण गणना की आवश्यकता होती है, जहाँ कुछ व्यक्तिगत प्रश्नों के उत्तर देने की लागत 1000 डॉलर से अधिक हो जाती है।
- Google DeepMind के AlphaProof जैसे विशेष मॉडलों के विपरीत, o3 एक सामान्य AI है जो उन्नत गणितीय कौशल प्रदर्शित करता है।
लेख सुझाव देता है कि यदि लागत कम होती है और स्कोर बेहतर होते हैं, तो AI गणितज्ञ मान विशेषज्ञों की कमी से सीमित वर्तमान सत्यापन प्रक्रियाओं को स्वचालित करके औपचारिक विधियों में परिवर्तन ला सकते हैं।