أطلقت Intern Large Models نموذج Intern-S2-397B، المتاح على Hugging Face. يتضمن الإصدار دعمًا من اليوم الأول من vLLM لتشغيل النموذج.
يُوصف النموذج بأنه يمتلك قدرات متعددة الوسائط، والاستدلال، والبرمجة، ووكيل علمي.
أطلقت Intern Large Models نموذج Intern-S2-397B، المتاح على Hugging Face. يتضمن الإصدار دعمًا من اليوم الأول من vLLM لتشغيل النموذج.
يُوصف النموذج بأنه يمتلك قدرات متعددة الوسائط، والاستدلال، والبرمجة، ووكيل علمي.
أطلقت IBM وNasa نموذج القمر الأساسي NASA-IBM Lunar Foundation Model كمصدر مفتوح، وهو نظام ذكاء اصطناعي يدمج عقوداً من البيانات القمرية متعددة الوسائط من المهمات الأمريكية واليابانية في تمثيل واحد. بُني النموذج على بنية TerraMind الخاصة بشركة IBM، ودمج الملاحظات بمقاييس وزوايا رؤية مختلفة لمعالجة تحديات مثل الإضاءة المعقدة ودقة البيانات.
أطلقت DeepSeek نموذجها الجديد DeepSeek V4-1 Flash. إنه نموذج Mixture-of-Experts (MoE) متعدد الوسائط يتميز بهيكل أساسي يحتوي على 552 مليار معلمة.
أطلقت inclusionAI نموذج المصدر المفتوح Ling-3.0-flash-VL، الذي يوسع قدرات اللغة والاستدلال لسلفه من خلال الفهم الأصلي للصور والفيديو.
يقدم الباحثون NeoMME، وهو مجموعة من المشفرات متعددة الوسائط متعددة اللغات بحجم 260M و800M تعالج النص ومقاطع الصور الخام باستخدام محوّل ثنائي الاتجاه واحد. وعلى عكس نماذج اللغة البصرية التوليدية، لا يعتمد NeoMME على أبراج رؤية مُدرَّبة مسبقاً بشكل منفصل أو فكوك سببية، بل يتم تدريب النموذج بأكمله من الصفر باستخدام هدف الانتشار المنفصل المقنع.
قامت DeepSeek بنشر نقطة فحص النموذج DeepSeek-V4-Flash-Vision-Exp على Hugging Face. المستودع متاح الآن للوصول العام.
نستخدم ملفات تعريف الارتباط لقياس الزيارات وتحسين الموقع. يمكنك قبول أو رفض ملفات تعريف الارتباط الخاصة بالتحليلات. سياسة الخصوصية