قامت DeepSeek بنشر نقطة فحص النموذج DeepSeek-V4-Flash-Vision-Exp على Hugging Face. المستودع متاح الآن للوصول العام.
DeepSeek تطلق DeepSeek-V4-Flash-Vision-Exp على Hugging Face
Thinking Machines تطلق Inkling، وTencent تحدث Hy3 برخصة Apache 2.0
يبرز أحدث ملخص لنتائج النماذج المفتوحة الإصدارات المهمة من Thinking Machines وTencent، بالإضافة إلى التحديثات من Poolside وDeepSeek.
مختبر الآلات المفكرة يُطلق نموذج Inkling الأساسي ذو الأوزان المفتوحة
أطلق مختبر الآلات المفكرة (Thinking Machines Lab) Inkling، أول عائلة نماذج أساسية ذات أوزان مفتوحة مُطلقة بالكامل. وُضع Inkling كنموذج أساسي متعدد الوسائط قابل للتخصيص بدلاً من كونه نموذجاً رائداً يهدف إلى تحقيق أعلى النتائج في الاختبارات المرجعية، ويدعم مدخلات النصوص والصور والصوت مع تعددية وسائط أصلية.
فريق Qwen التابع لشركة علي بابا يُصدر النسخة الأولية من Qwen3.8-Flash-Next، وهي نموذج MoE بحجم 125B يستعرض طراز Qwen4
أطلق فريق Qwen التابع لشركة علي بابا نموذج Qwen3.8-Flash-Next، وهو نموذج متعدد الوسائط مفتوح الأوزان من نوع Mixture-of-Experts مصمم لعرض الطراز المعماري لسلسلة Qwen4 القادمة. يجمع هذا الملف المحفوظ بين هيكل أساسي بحجم 125B وجدول تضمين N-gram بحجم 51B ووحدات تنبؤ متعددة الرموز بحجم 4B، مع تفعيل 6B معلمة فقط لكل رمز.
Zhipu AI تُطلق GLM-5.3-Flash، نموذج مفتوح الوزن متعدد الوسائط
أطلقت Zhipu AI نموذج GLM-5.3-Flash، وهو أول نموذج متعدد الوسائط بشكل أصلي في سلسلة GLM-5 وأول إصدار بوزن مفتوح لهيكلية glm5_next. يُدرَّب النموذج ذو الـ 320 مليار معامل على مجموعة بيانات متعددة الوسائط تحتوي على 30 تريليون رمز (token)، ويتميز بآلية انتباه هجينة تجمع بين الانتباه الخطي والتشتت لتقليل تكاليف معالجة السياقات الطويلة.
ZhiPu تطلق GLM-5.3-Flash، نموذج متعدد الوسائط يحتوي على 320 مليار معامل
تقدم ZhiPu نموذج GLM-5.3-Flash، وهو أول نموذج متعدد الوسائط بشكل أصلي في سلسلة GLM-5، يتميز ببنية هجينة تجمع بين الانتباه المتناثر والخطي لتقليل تكاليف خدمة السياق الطويل مع الحفاظ على الدقة.