تشير الاختبارات الأولية لنموذج DeepSeek v4 Flash إلى تحسن ملحوظ في مهارات تصميم واجهة المستخدم وتجربة المستخدم. وعلى الرغم من هذه التحسينات، يُشار إلى أن النموذج جائع للرموز (tokens).
تظهر الاختبارات الأولية لـ DeepSeek v4 Flash تحسينات كبيرة في قدرات تصميم واجهة المستخدم/تجربة المستخدم
تشارك PIVOT مسوحات البادئة عبر مجموعات الاستعلام لتسريع الانتباه المتناثر على مستوى الرموز
PIVOT (الفهرسة الوسيطة عبر اجتياز بادئة كاملة) هي بديل جاهز للاستخدام لا يتطلب تدريبًا، لفهرس DeepSeek Sparse Attention (DSA)، ويقلل من التكرار الحسابي عن طريق مشاركة مسح بادئة واحدة عبر مجموعة من الاستعلامات القريبة. وبدلاً من تقييم كل رمز سابق لكل استعلام على حدة، تجمع PIVOT المجموعة في استعلام وسيط واحد للحصول على مجموعة مرشحة، يتم منها اختيار أفضل k رموز لكل استعلام.
تكميم دفتر أكوام متجمع لضغط الصور القائم على غاوس ثنائي الأبعاد
يقدم الباحثون تكميم المتجه الموجه بالعناقيد (CGVQ)، وهي طريقة مصممة لتحسين أداء معدل التشويه في ضغط الصور القائم على البدع الغاوسية. يقسم النهج معاملات غاوس إلى مجموعات متجانسة قبل التكميم، مما يعالج عدم الكفاءة الناتجة عن تخزين أعداد كبيرة من معاملات النقطة العائمة لكل بدعة.
يضيف Diffusers دعمًا أصليًا لاستدلال Nunchaku Lite بدقة 4 بت
يدعم Hugging Face Diffusers الآن تحميل نقاط تفتيش Nunchaku Lite بشكل أصلي عبر `from_pretrained()`، مما يلغي الحاجة إلى محرك استدلال منفصل أو ترجمة CUDA محلية. تستفيد هذه التكاملات من طريقة SVDQuant لتشغيل طبقات المحوّل بأوزان وتنشيطات بدقة 4 بت (W4A4)، مما يقلل بشكل كبير من استخدام الذاكرة مع تحسين سرعة الاستدلال.
مستخدم يطلب كميّة ConvRot INT8 لـ FireRed Image Edit v1.1
يسأل مستخدم في منتديات Hugging Face عن التطوير المحتمل لإصدار ConvRot بكمّيّة INT8 أو FP8 لنموذج FireRed Image Edit v1.1.
ZimengXiong ينقل Hunyuan3D إلى MLX لأجهزة Apple Silicon وiPhone
أكمل المطور ZimengXiong نقل نماذج Hunyuan3D-Paint وHunyuan3D-Shape إلى Swift-MLX وPython MLX، مما يتيح توليد الصور إلى ثلاثي الأبعاد محليًا على أجهزة Apple Silicon. يتم توزيع العمل كتطبيق سطح مكتب مفتوح المصدر Modelr لنظامي macOS وiOS، بالإضافة إلى الكود المصدري لدمج التقنية في تطبيقات Swift.