أطلقت Google DeepMind نموذج EmbeddingGemma 2، وهو نموذج تضمين متعدد الوسائط مفتوح المصدر يربط النص والرمز والصور ومقاطع الفيديو والصوت في فضاء متجهي موحد ذي 768 بُعدًا. يتكون النموذج من 740 مليون معلمة إجمالاً، حيث يجمع بين مشفر نصي يحتوي على 270 مليون معلمة ومشفرين معتمدين على الوحدات النمطية للرؤية (170 مليون) والصوت (300 مليون).

  • مصمم للعمل على الأجهزة الاستهلاكية مثل الأجهزة المحمولة وأجهزة الكمبيوتر المحمول للحصول على تمثيلات دلالية منخفضة زمن الوصول.
  • يدعم التطبيقات على الجهاز بما في ذلك البحث، والتوليد المعزز بالاسترجاع (RAG)، والتصنيف، والتجميع.
  • متاح كنموذج مفتوح عبر Hugging Face.