PP-OCRv6، وهو نموذج جديد للتعرف الضوئي على الحروف (OCR)، متاح الآن على Hugging Face. يدعم 50 لغة ويتراوح عدد معاملاته من 1.5 مليون إلى 34.5 مليون معاملاً، مما يوفر دقة وكفاءة محسّنتين عبر لغات متنوعة.
إصدار PP-OCRv6 على Hugging Face مع دعم لـ 50 لغة
جوجل تنشر التقرير الفني الخاص بـ DiffusionGemma
نشرت جوجل تقريرًا فنيًا حول DiffusionGemma، متاح على arXiv. يوضح المستند تفاصيل بنية النموذج وقدراته كجزء من عائلة Gemma.
مايكروسوفت تطلق Mage-Flow، نموذجًا أصليًا بدقة 4B لتوليد الصور وتعديلها
أطلقت مايكروسوفت Mage-Flow، وهي مجموعة توليدية مدمجة بحجم 4B مصممة للتوليد الفعال للنصوص إلى صور وتحرير الصور بناءً على التعليمات. يحقق النظام جودة تنافسية مع الحالة السائدة من خلال التصميم المشترك لمُرمِّز خفيف الوزن يُدعى Mage-VAE ومحول الانتشار متعدد الوسائط بدقة أصلية (NR-MMDiT).
SenseNova تطلق نماذج SenseNova-U1-8b-MoT مفتوحة المصدر لتصميم الإنفوجرافيك
أطلقت SenseNova سلسلة SenseNova-U1-8b-MoT، وهي مجموعة من نماذج Mixture of Transformers المصممة لتوليد وتحرير الإنفوجرافيك الكثيف. الإصدار الأحدث، Infographic V2، يعمل كنموذج أساسي مكون من 50 خطوة ومرخص بموجب رخصة Apache 2.
نماذج Alibaba للذكاء الاصطناعي تتفوق على Meta وGoogle بـ3 مليارات تحميل على Hugging Face
وفقًا لتقرير "State of Open Models: Summer 2026 Observations" الصادر عن Hugging Face، وصلت نماذج الذكاء الاصطناعي التابعة لشركة Alibaba إلى إجمالي تراكمي يبلغ 3 مليارات تحميل على المنصة. يُمثل هذا الإنجاز تحولًا كبيرًا في مشهد المصادر المفتوحة، حيث تجاوزت Alibaba كلًا من Meta وGoogle في إجمالي عمليات تحميل النماذج.
Z.ai تطلق GLM-5.3 مع تدريب ما بعد الامتداد
أعلنت Z.ai عن GLM-5.3، وهو نموذج جديد يحقق أداءً متقدمًا في معايير برمجة الوكلاء من خلال توسيع تدريب ما بعد النموذج الأساسي GLM-5.2. يتفوق النموذج ذو ~750B معلمة حاليًا على Kimi K3 ويساوي أو يتجاوز Claude Fable 5 و GPT-5.6-Sol في معايير مختلفة.