DeepSeek v4 Flash मॉडल का प्रारंभिक परीक्षण इसके उपयोगकर्ता इंटरफ़ेस और उपयोगकर्ता अनुभव डिज़ाइन कौशल में उल्लेखनीय सुधार की ओर इशारा करता है। इन सुधारों के बावजूद, मॉडल को टोकन-भूखा बताया गया है।
DeepSeek v4 Flash का प्रारंभिक परीक्षण UI/UX डिज़ाइन क्षमताओं में महत्वपूर्ण सुधार दिखाता है
PIVOT क्वेरी समूहों के बीच प्रीफिक्स स्कैन साझा करके टोकन-स्तर की विरल एटेंशन को तेज़ करता है
PIVOT (Proxy Indexing Via One full-prefix Traversal) एक ट्रेनिंग-फ्री, ड्रॉप-इन प्रतिस्थापन है DeepSeek Sparse Attention (DSA) इंडेक्सर के लिए जो निकटवर्ती क्वेरियों के समूह में एक प्रीफिक्स स्कैन साझा करके कंप्यूटेशनल अतिरेक को कम करता है। हर क्वेरी के लिए प्रत्येक पूर्ववर्ती टोकन को अलग-अलग स्कोर करने के बजाय, PIVOT समूह को एक सिंगल प्रॉक्सी क्वेरी में एग्रीगेट करता है ताकि एक उम्मीदवार सेट प्राप्त किया जा सके, जिससे हर क्वेरी के लिए टॉप-k टोकन चुने जाते हैं।
2D गॉसियन-आधारित छवि संपीड़न के लिए क्लस्टर कोडबुक क्वांटीकरण
शोधकर्ता Cluster-Guided Vector Quantization (CGVQ) प्रस्तुत करते हैं, जो गॉसियन प्राइमिटिव-आधारित छवि संपीड़न में दर-विकृति प्रदर्शन को बेहतर बनाने के लिए डिज़ाइन किया गया एक विधि है। दृष्टिकोण क्वांटीकरण से पहले गॉसियन पैरामीटर को समजात समूहों में विभाजित करता है, जिसमें प्रति प्राइमिटिव बड़ी संख्या में फ्लोटिंग-पॉइंट पैरामीटर संग्रहीत करने के कारण होने वाली अक्षमता को दूर किया जाता है।
Diffusers में Nunchaku Lite 4-बिट इनफरेंस के लिए नेटिव समर्थन जोड़ा गया
Hugging Face Diffusers अब `from_pretrained()` के माध्यम से Nunchaku Lite चेकपॉइंट्स को नेटिव रूप से लोड करने का समर्थन करता है, जिससे अलग इनफरेंस इंजन या स्थानीय CUDA कंपाइलेशन की आवश्यकता समाप्त हो जाती है। यह एकीकरण SVDQuant विधि का उपयोग करके 4-बिट वेट्स और एक्टिवेशन (W4A4) के साथ ट्रांसफॉर्मर लेयर को चलाता है, जिससे मेमोरी उपयोग काफी कम होता है और इनफरेंस गति में सुधार होता है।
उपयोगकर्ता ने FireRed Image Edit v1.1 के लिए INT8 ConvRot क्वांटीकरण का अनुरोध किया
Hugging Face फोरम पर एक उपयोगकर्ता FireRed Image Edit v1.1 मॉडल के लिए INT8 या FP8 ConvRot संस्करण के संभावित विकास के बारे में पूछ रहा है।
ZimengXiong ने Apple Silicon और iPhone के लिए MLX पर Hunyuan3D पोर्ट किया
डेवलपर ZimengXiong ने Hunyuan3D-Paint और Hunyuan3D-Shape मॉडल का Swift-MLX और Python MLX पोर्ट पूरा किया है, जिससे Apple Silicon डिवाइस पर स्थानीय रूप से इमेज-टू-3D जनरेशन संभव हुआ है। यह काम macOS और iOS के लिए ओपन-सोर्स Modelr डेस्कटॉप ऐप के रूप में वितरित किया गया है, साथ ही Swift एप्लिकेशन में तकनीक को एकीकृत करने के लिए स्रोत कोड भी उपलब्ध है।