الموضوع · Image generation
lab NVIDIA Research · منذ 11 ساعة · مشاهدتان

إنفيديا تقدم FusionRelight لإعادة إضاءة البورتريه في الوقت الفعلي عبر دمج المعرفة الهجينة للمجال

قدم باحثو إنفيديا FusionRelight، وهي طريقة لإعادة إضاءة البورتريه تجمع بين نقل الإضاءة المادي المعقول والحفاظ على الهوية والاستدلال في الوقت الفعلي المضغوط. تستخدم هذه الطريقة دمج المعرفة الهجينة للمجال (HDKF)، وهو إطار تدريبي يستخلص مسبقاً من الفيزياء والانعكاسية والواقعية من البيانات الاصطناعية، وواحدة-ضوء-في-الوقت (OLAT)، والبيانات في البرية، لنموذج طالب.

lab NVIDIA Research · منذ 18 يوم · 13 مشاهدة

تكميم دفتر أكوام متجمع لضغط الصور القائم على غاوس ثنائي الأبعاد

يقدم الباحثون تكميم المتجه الموجه بالعناقيد (CGVQ)، وهي طريقة مصممة لتحسين أداء معدل التشويه في ضغط الصور القائم على البدع الغاوسية. يقسم النهج معاملات غاوس إلى مجموعات متجانسة قبل التكميم، مما يعالج عدم الكفاءة الناتجة عن تخزين أعداد كبيرة من معاملات النقطة العائمة لكل بدعة.

media r/LocalLLaMA · منذ 14 يوم · 13 مشاهدة

تظهر الاختبارات الأولية لـ DeepSeek v4 Flash تحسينات كبيرة في قدرات تصميم واجهة المستخدم/تجربة المستخدم

تشير الاختبارات الأولية لنموذج DeepSeek v4 Flash إلى تحسن ملحوظ في مهارات تصميم واجهة المستخدم وتجربة المستخدم. وعلى الرغم من هذه التحسينات، يُشار إلى أن النموذج جائع للرموز (tokens).

lab Hugging Face Blog · منذ 23 يوم · 3 مشاهدات

يضيف Diffusers دعمًا أصليًا لاستدلال Nunchaku Lite بدقة 4 بت

يدعم Hugging Face Diffusers الآن تحميل نقاط تفتيش Nunchaku Lite بشكل أصلي عبر `from_pretrained()`، مما يلغي الحاجة إلى محرك استدلال منفصل أو ترجمة CUDA محلية. تستفيد هذه التكاملات من طريقة SVDQuant لتشغيل طبقات المحوّل بأوزان وتنشيطات بدقة 4 بت (W4A4)، مما يقلل بشكل كبير من استخدام الذاكرة مع تحسين سرعة الاستدلال.

media r/LocalLLaMA · منذ 23 يوم · 6 مشاهدات

مايكروسوفت تطلق Mage-Flow، نموذجًا أصليًا بدقة 4B لتوليد الصور وتعديلها

أطلقت مايكروسوفت Mage-Flow، وهي مجموعة توليدية مدمجة بحجم 4B مصممة للتوليد الفعال للنصوص إلى صور وتحرير الصور بناءً على التعليمات. يحقق النظام جودة تنافسية مع الحالة السائدة من خلال التصميم المشترك لمُرمِّز خفيف الوزن يُدعى Mage-VAE ومحول الانتشار متعدد الوسائط بدقة أصلية (NR-MMDiT).

lab Hugging Face Blog · منذ 28 يوم · 5 مشاهدات

تمكين NVIDIA NeMo Automodel من ضبط نموذج الانتشار الموزع مع Hugging Face Diffusers

قامت NVIDIA وHugging Face بدمج NVIDIA NeMo Automodel مع مكتبة 🤗 Diffusers لتوفير تدريب موزع من الدرجة الإنتاجية لنماذج الانتشار مفتوحة المصدر. يتيح هذا التعاون للمستخدمين ضبط أي نموذج بتنسيق Diffusers على Hugging Face Hub دون الحاجة إلى تحويل نقاط التفتيش أو إعادة كتابة كود النموذج.