NanoMaestro Realtime एक 50MB का AI संगीत मॉडल है जिसमें 13M पैरामीटर हैं जो 2-परत LSTM का उपयोग करके रियल-टाइम में पियानो संगीत उत्पन्न करता है। यह ONNX और Transformers.js के साथ WASM के माध्यम से ब्राउज़र में स्थानीय रूप से चलता है, जिसके लिए GPU या सर्वर बैकएंड की आवश्यकता नहीं है, और यह पुराने Raspberry Pi मॉडलों पर भी काम करता है।
AI संगीत मॉडल ब्राउज़र में अधिकांश CPU पर रियल-टाइम पर चलता है
ग्रैडियो ने Workflow1111 जारी किया, AUTOMATIC1111 की सुविधाओं को ग्रैडियो ग्राफ के रूप में पुनर्निर्मित करते हुए
ग्रैडियो ने Workflow1111 जारी किया है, एक परियोजना जो gr.Workflow फ्रेमवर्क का उपयोग करके AUTOMATIC1111 के stable-diffusion-webui सुविधा सेट का अधिकांश पुनर्निर्माण करती है। इस एप्लिकेशन में सातानवे नोड्स से बने ग्यारह मीडिया पाइपलाइन वाले एकल कैनवास पर शामिल हैं, जिनमें टेक्स्ट-टू-इमेज, इमेज-टू-वीडियो और विभिन्न प्रीप्रोसेसिंग कार्य शामिल हैं।
OpenEnv ने TRL का उपयोग करके सूर्य नर्रेदी के वॉटरकलर पेंटिंग मॉडल को पुन: उत्पन्न किया
एक इंजीनियर ने सूर्य नर्रेदी के वायरल प्रोजेक्ट की एक प्रतिलिपि को ओपन-सोर्स किया, जो जावास्क्रिप्ट और रीइन्फोर्सेमेंट लर्निंग का उपयोग करके एक कोडिंग मॉडल को वॉटरकलर पेंट करने के लिए प्रशिक्षित करता है। इस कार्यान्वयन में TRL लाइब्रेरी और OpenEnv का उपयोग Hugging Face पर प्रशिक्षण, स्कोरिंग और इनफरेंस के लिए एक एंड-टू-एंड पाइपलाइन बनाने के लिए किया गया है।
Diffusers में Nunchaku Lite 4-बिट इनफरेंस के लिए नेटिव समर्थन जोड़ा गया
Hugging Face Diffusers अब `from_pretrained()` के माध्यम से Nunchaku Lite चेकपॉइंट्स को नेटिव रूप से लोड करने का समर्थन करता है, जिससे अलग इनफरेंस इंजन या स्थानीय CUDA कंपाइलेशन की आवश्यकता समाप्त हो जाती है। यह एकीकरण SVDQuant विधि का उपयोग करके 4-बिट वेट्स और एक्टिवेशन (W4A4) के साथ ट्रांसफॉर्मर लेयर को चलाता है, जिससे मेमोरी उपयोग काफी कम होता है और इनफरेंस गति में सुधार होता है।
NVIDIA NeMo Automodel ने Hugging Face Diffusers के साथ वितरित डिफ्यूजन मॉडल फाइन-ट्यूनिंग को सक्षम बनाया
NVIDIA और Hugging Face ने NVIDIA NeMo Automodel को 🤗 Diffusers लाइब्रेरी के साथ एकीकृत किया है ताकि ओपन-सोर्स डिफ्यूजन मॉडल्स के लिए उत्पादन-स्तरीय, वितरित प्रशिक्षण प्रदान किया जा सके। इस सहयोग से उपयोगकर्ताओं को किसी भी Diffusers-फॉर्मेट मॉडल को Hugging Face Hub पर बिना चेकपॉइंट रूपांतरण या मॉडल कोड पुनर्लेखन की आवश्यकता के फाइन-ट्यून करने की अनुमति मिलती है।
सिमन विलिसन ने GPT-5.6 और gpt-image-2 का उपयोग करके Codex Desktop के लिए कस्टम पेट बनाया
सिमन विलिसन OpenAI के GPT-5.6 Sol मॉडल और gpt-image-2 API का लाभ उठाते हुए Codex Desktop एप्लिकेशन के लिए एक कस्टम एनिमेटेड "पेट" कैसे बनाया, यह दिखाते हैं।