Google DeepMind ने EmbeddingGemma 2 जारी किया है, जो एक ओपन-सोर्स मल्टीमोडल एम्बेडिंग मॉडल है जो टेक्स्ट, कोड, इमेजेस, वीडियो और ऑडियो को एक एकीकृत 768-आयामी वेक्टर स्पेस में मैप करता है। मॉडल में कुल 740 मिलियन पैरामीटर हैं, जिसमें 270M पैरामीटर वाले टेक्स्ट एन्कोडर को मोड्यूलर विज़न (170M) और ऑडियो (300M) एन्कोडर्स के साथ जोड़ा गया है।

  • कम लेटेंसी वाले सेमांटिक रिप्रजेंटेशन के लिए मोबाइल डिवाइस और लैपटॉप जैसे कंज़्यूमर हार्डवेयर पर चलने के लिए डिज़ाइन किया गया।
  • सर्च, रेट्रीवल-एंगमेंटेड जनरेशन (RAG), क्लासिफिकेशन और क्लस्टरिंग सहित ऑन-डिवाइस एप्लिकेशंस का समर्थन करता है।
  • Hugging Face के माध्यम से एक ओपन मॉडल के रूप में उपलब्ध।