H2O.ai ने घोषणा की है कि इसका h2oGPTe Agent सामान्य AI असिस्टेंट्स (GAIA) बेंचमार्क पर #1 स्थान हासिल कर चुका है, जिसमें 75% सटीकता दर प्राप्त हुई है। यह परिणाम GAIA टेस्ट सेट पर C ग्रेड प्राप्त करने का पहला मौका दर्शाता है और एजेंट को OpenAI के Deep Research से आगे रखता है जबकि Manus की प्रदर्शन क्षमता के बराबर है।

  • एजेट जटिल विश्लेषणात्मक कार्यों के लिए विशेष तर्क मोड के साथ Anthropic के Claude 3.7 Sonnet का उपयोग करता है।
  • नई क्षमताओं में उन्नत ब्राउज़र नेविगेशन, Google और Bing जैसे कई इंजनों पर एकीकृत खोज, और सॉफ्टवेयर इंजीनियरिंग के लिए GitHub इंटीग्रेशन शामिल हैं।
  • H2O.ai जोर देता है कि इसके परिणाम वैलिडेशन सेट के बजाय GAIA टेस्ट सेट पर आधारित हैं, क्योंकि इसमें डेटा दूषित होने की संभावना हो सकती है।
  • पारदर्शिता बढ़ाने के लिए अब प्लेटफ़ॉर्म में लाइव स्रोत एट्रिब्यूशन और इनलाइन रिस्पॉन्स साइटेशन शामिल हैं।

यह उपलब्धि तर्क, बहु-मोडलिटी और टूल उपयोग की आवश्यकता वाले वास्तविक कार्य संभालने में सक्षम AI असिस्टेंट्स बनाने के H2O.ai के दृष्टिकोण को मान्य करती है।