OpenAI ने o3 की घोषणा की है, जो इसका अगली पीढ़ी का तर्क मॉडल है, जो तर्क, कोडिंग और गणितीय समस्याओं के समाधान में नए रिकॉर्ड स्थापित करता है। मॉडल कम-कंप्यूट मोड में सेमी-प्राइवेट ARC-AGI eval पर 75.7% स्कोर हासिल करता है और हाई-कंप्यूट मोड में 87.5% स्कोर हासिल करता है।

  • o3 ने ARC-AGI (कम-कंप्यूट) पर 75.7% और (हाई-कंप्यूट) पर 87.5% स्कोर किया, जो मानव-स्तर की सीमा 85% को पार करता है।
  • यह 2024 अमेरिकन मैथेमेटिकल ओलंपियाड (AIME) पर 96.7% स्कोर हासिल करता है और EpochAI के Frontier Math Benchmark पर 25.2% स्कोर करता है।
  • कोडिंग में, o3 ने SWE-Bench Verified पर 71.7 स्कोर किया (o1 से 22.8 अंक अधिक) और Codeforces पर 2,727 की Elo रेटिंग प्राप्त की।
  • मॉडल में 128K टोकन का संदर्भ विंडो है और इसे पिछले इटरेशन की तुलना में चलाने के लिए काफी महंगा माना जाता है।