تُقدم جوجل جيما 3، وهي عائلة جديدة من النماذج المفتوحة متعددة الوسائط خفيفة الوزن تتراوح بين 1 إلى 27 مليار معلمة. تضيف هذه التحديثات فهم الرؤية، ودعم ما لا يقل عن 128K رمزًا للسياق، وتغطية لغوية أوسع مقارنة بالإصدارات السابقة.
- تستخدم النماذج مشفر رؤية SigLIP المخصص مع طريقة Pan & Scan لدقة صور مرنة.
- تشمل التغييرات في البنية تداخلًا بنسبة 5:1 بين طبقات الانتباه المحلي والعالمي لتقليل استخدام ذاكرة KV-cache أثناء الاستدلال بسياق طويل.
- يدعم النموذج 1B سياقًا يتكون من 32K رمز، بينما تدعم النماذج الأكبر 128K رمزًا.
- يعتمد التدريب على تقنيات التقريب المعرفي من نماذج Gemini المتطورة وصفة تدريب ما بعد التدريب الجديدة.
- تتوافق أداء Gemma3-4B-IT مع Gemma2-27B-IT، وتكون Gemma3-27B-IT قابلة للمقارنة مع Gemini-1.5-Pro في الاختبارات المعيارية.
يوفر الإصدار جميع متغيرات النماذج للمجتمع، مما يمكّن من قدرات متعددة الوسائط قوية على عتاد المستهلك القياسي.