OpenAI ने अपने o3 और o4-mini मॉडल जारी किए हैं, जो अत्याधुनिक तर्क क्षमताओं को वेब ब्राउज़िंग, Python निष्पादन और छवि विश्लेषण सहित पूर्ण उपकरण उपयोग के साथ जोड़ते हैं। इन मॉडल्स को जटिल गणितीय, कोडिंग और वैज्ञानिक चुनौतियों को हल करने की उनकी क्षमता को बढ़ाने के लिए सोच की श्रृंखलाओं पर बड़े पैमाने पर पुनर्बल सीखने (reinforcement learning) का उपयोग करके प्रशिक्षित किया गया है।

  • मॉडल्स अपनी सोच की प्रक्रिया में क्षमताओं को बढ़ाने के लिए उपकरणों का उपयोग करते हैं, जैसे छवियों को काटना या Python के माध्यम से डेटा का विश्लेषण करना।
  • OpenAI की सुरक्षा सलाहकार समूह (Safety Advisory Group) ने अपने तैयारी ढांचे (Preparedness Framework) के संस्करण 2 के तहत मॉडल्स की समीक्षा की।
  • मूल्यांकन से पता चला कि न तो कोई मॉडल जैविक और रासायनिक क्षमता, साइबर सुरक्षा या AI स्व-उन्नति में उच्च सीमा तक पहुंचता है।

यह रिलीज़ अद्यतित ढांचे के तहत पहली लॉन्चिंग को चिह्नित करती है, जिसमें कंपनी ने नोट किया है कि उन्नत तर्क विचारशील संरेखण (deliberative alignment) के माध्यम से सुरक्षा और मजबूती में सुधार के लिए नए मार्ग प्रदान करता है।