Google और Google DeepMind ने Gemini 1.0 पेश किया है, जो टेक्स्ट, कोड, ऑडियो, इमेज और वीडियो को नैटिवली समझने और संयोजित करने के लिए डिज़ाइन किए गए बड़े-स्केल मल्टीमोडल मॉडल्स का एक नया परिवार है।

  • पहले वर्जन में तीन अनुकूलित आकार शामिल हैं: जटिल कार्यों के लिए Gemini Ultra, कार्यों में स्केलिंग के लिए Gemini Pro, और डिवाइस पर दक्षता के लिए Gemini Nano।
  • Gemini Ultra 32 में से 30 व्यापक रूप से उपयोग किए जाने वाले अकादमिक बेंचमार्क्स पर स्टेट-ऑफ़-द-आर्ट प्रदर्शन हासिल करता है और MMLU पर मानव विशेषज्ञों को 90.0% स्कोर के साथ पार करने वाला पहला मॉडल है।
  • मॉडल्स को जमीन से मल्टीमोडल बनाने के लिए बनाया गया है, जिससे वे अलग-अलग इनपुट्स पर तर्क कर सकते हैं बिना अलग-अलग घटकों को जोड़े हुए।

यह रिलीज़ सामान्य उद्देश्य वाले AI बनाने में एक महत्वपूर्ण कदम है जो डेवलपर्स और एंटरप्राइजेस के लिए ऐप्स बनाने और स्केल करने के तरीके को बढ़ावा दे सकता है।