स्रोत · Hugging Face Blog
lab Hugging Face Blog · 1 दिन पहले · 8 बार देखा गया

शून्य-शॉट तालिका पूर्वानुमान के लिए NVIDIA ने खुला Kumo Tabular फाउंडेशन मॉडल जारी किया

NVIDIA ने Kumo Tabular जारी किया है, जो तालिका वर्गीकरण और रिग्रेशन के लिए एक खुला फाउंडेशन मॉडल है जो प्रशिक्षण या फीचर इंजीनियरिंग की आवश्यकता के बिना इन-कॉन्टेक्स्ट लर्निंग के माध्यम से संचालित होता है। स्ट्रक्चरल काज़ुअल मॉडल्स द्वारा उत्पन्न कृत्रिम डेटा पर ही प्रीट्रेन किया गया, इस मॉडल को 28M से 215M पैरामीटर तक के तीन आकारों में उपलब्ध कराया गया है।

lab Hugging Face Blog · 2 दिन पहले OSWorld 2.0 · 61.7% · 9 बार देखा गया

Holo4: GUIs, कोड और API के लिए सामान्यीकृत एजेंटिक मॉडल

Holo4 H Company द्वारा एजेंटिक मॉडल्स की एक नई श्रृंखला है, जो 27B डेंस और 35B-A3B मिक्सचर ऑफ एक्सपर्ट्स आकारों में उपलब्ध है। ये मॉडल किसी भी इंटरफ़ेस—GUIs, कोड, MCP या API—के माध्यम से सॉफ़्टवेयर के साथ इंटरैक्ट करते हैं और एक ही मॉडल का उपयोग करके डेस्कटॉप, वेब, Android और सैंडबॉक्स पर चलते हैं।

lab Hugging Face Blog · 4 घंटे पहले · 1 बार देखा गया

ओपन टीटीएस लीडरबोर्ड स्केलेबल मल्टीलिंगुअल टीटीएस इवैल्यूएशन को लांच करता है

टेक्स्ट-टू-स्पीच (TTS) इवैल्यूएशन में विखंडन और मानकीकरण की कमी को दूर करने के लिए ओपन टीटीएस लीडरबोर्ड जारी किया गया है, जो धीमे, एरीना-आधारित मानव प्राथमिकता स्कोर पर निर्भर रहने के बजाय ऑब्जेक्टिव मेट्रिक्स का उपयोग करता है। यह Qwen3 ASR और WavLM एम्बेडिंग्स का उपयोग करके इंटेलिजिबिलिटी, स्पीड और स्पीकर समानता के आधार पर मॉडल का मूल्यांकन करता है।

lab Hugging Face Blog · 1 दिन पहले · 1 बार देखा गया

ProvenanceGuard ने MCP एजेंट्स में स्रोत-जागरूक सत्यापण जोड़ा है

ProvenanceGuard एक पोस्ट-जनरेशन सत्यापण परत है जो Model Context Protocol (MCP) एजेंट्स के लिए है और यह सुनिश्चित करके क्रॉस-स्रोत मिश्रण का पता लगाती है कि दावों को सही प्रमाण स्रोत से जोड़ा गया हो। सिस्टम MCP ट्रेस का विश्लेषण करता है बिना एजेंट को पुनः प्रशिक्षित किए, उत्तरों को दावों में तोड़ता है और सत्यापित करता है कि सहायक स्रोत वह मेल खाता है जो आउटपुट में नामित या संकेतित किया गया था।

lab Hugging Face Blog · 6 दिन पहले · 13 बार देखा गया

Liquid AI ने दृश्य-भाषा मॉडल निष्पादन को तेज़ करने के लिए LFM2.5-VL-DSpark जारी किया

Liquid AI ने LFM2.5-VL-3B दृश्य-भाषा मॉडल के लिए निष्पादन को तेज़ करने के लिए एक अनुमानित डिकोडिंग ड्राफ्टर, LFM2.5-VL-DSpark ड्राफ्ट मॉडल जारी किया है। ड्राफ्टर उम्मीदवार टोकन उत्पन्न करने के लिए लक्ष्य मॉडल के स्थिर परतों से छिपी अवस्थाओं को पकड़ता है, जिसमें केवल 280M पैरामीटर (8.9% ओवरहेड) जुड़े हैं जबकि सभी मोडेलिटीज़ में समान आयाम बनाए रखे गए हैं।

lab Hugging Face Blog · 7 दिन पहले · 16 बार देखा गया

NVIDIA Warp और MjWarp GPU-त्वरित समानांतर रोबोटिक्स सिम्युलेशन को सक्षम बनाते हैं

NVIDIA Warp पर निर्मित MuJoCo Warp (MJWarp), संगत MuJoCo मॉडलों को GPU स्केल पर चलने की अनुमति देता है, जिससे एक ही कॉल में सैकड़ों या हज़ारों स्वतंत्र सिम्युलेशन दुनियाओं के विकास की सुविधा मिलती है। यह आर्किटेक्चर एकमात्र वातावरण के लिए अल्पविलंबता को कम करने से ध्यान को समग्र थ्रूपुट में सुधार पर स्थानांतरित करता है, जो पुनर्बल सीखने और बड़े-पैमाने के नमूनाकरण का समर्थन करता है।

lab Hugging Face Blog · 7 दिन पहले · 27 बार देखा गया

NVIDIA ने ओपन-वेट Nemotron 3 डायरिज़ेशन मॉडल जारी किया

NVIDIA ने रियल-टाइम स्पीकर डायरिज़ेशन के लिए एक ओपन-वेट, 100M-पैरामीटर वाला मॉडल Nemotron 3 Diarization जारी किया है जो आठ स्पीकर्स तक का समर्थन करता है। यह मॉडल VoiceArena के डायरिज़ेशन-बेंच लीडरबोर्ड पर #1 स्थान पर है, जिसमें 14.72% डायरिज़ेशन एरर रेट (DER) है, जो अगले रैंक वाले सिस्टम की तुलना में लगभग 24% सापेक्ष कमी दिखाता है।

lab Hugging Face Blog · 8 दिन पहले · 25 बार देखा गया

AISI ने पांच बेंचमार्क पर छह फ्रंटियर मॉडल के लिए सत्यापित मूल्यांकन परिणाम जारी किए

UK AI Security Institute (AISI) ने बेंचमार्क पुनरुत्पादन को बेहतर बनाने के लिए EvalEval के Evaluation Cards प्लेटफ़ॉर्म के माध्यम से सार्वजनिक रूप से रिपोर्ट की गई मूल्यांकन विधियों और निष्कर्षों को उपलब्ध कराया है। इस रिलीज़ में पांच विशिष्ट बेंचमार्क: HealthBench, FrontierMath, Humanity's Last Exam, SWE-Bench Pro, और Terminal-Bench 2.0 के लिए सत्यापित परिणाम, संदर्भ और कॉन्फ़िगरेशन जानकारी शामिल है।

lab Hugging Face Blog · 8 दिन पहले · 24 बार देखा गया

स्थानीय निष्पादन के लिए ggml kernels के माध्यम से Transformers में GGUF समर्थन जोड़ा गया

Hugging Face की Transformers लाइब्रेरी अब GGUF क्वांटाइज्ड मॉडल लोड करने का समर्थन करती है, जिसमें llama.cpp के निकट प्रदर्शन लाने के लिए underlying ggml kernels का उपयोग किया गया है। इस एकीकरण से डेवलपर्स को समर्थित हार्डवेयर पर मानक PyTorch-आधारित API के भीतर ही क्वांटाइज्ड चेकपॉइंट्स चلانے की सुविधा मिलती है।

lab Hugging Face Blog · 9 दिन पहले · 16 बार देखा गया

oMLX के निर्माता जून किम MLX समुदाय का समर्थन करने के लिए Hugging Face में शामिल हुए

oMLX के निर्माता और रखरखावकर्ता जून किम ने MLX समुदाय का समर्थन करने के लिए Hugging Face में शामिल हो गए हैं। यह कदम ओपन-सोर्स प्रोजेक्ट को एक साइड जॉब से पूरी तरह बनाए रखी गई और वित्त पोषित पहल में बदलने के द्वारा स्थिरता और तेज़ विकास प्रदान करने के उद्देश्य से है।

lab Hugging Face Blog · 9 दिन पहले · 12 बार देखा गया

tokenizers v1 रिलीज़ कैंडिडेट बिटस्ट्रीम विभाजन और कैशिंग के माध्यम से 3-30x तेज एन्कोडिंग प्रदान करता है

tokenizers लाइब्रेरी ने टेक्स्ट एन्कोडिंग के लिए प्रदर्शन में महत्वपूर्ण सुधार करने वाला एक संस्करण 1 रिलीज़ कैंडिडेट जारी किया है, जो प्रशिक्षण और सर्विंग वर्कफ़्लो में बॉटलनेक को दूर करता है। यह अपडेट v0.23 के साथ API संगतता बनाए रखते हुए दस मॉडल परिवारों में महत्वपूर्ण गति वृद्धि प्रदान करता है।

lab Hugging Face Blog · 9 दिन पहले MMLU · 77.0% · 17 बार देखा गया

मल्टीवर्स LLM ब्लॉक हटाने को आइसिंग अनुकूलन के रूप में पुनर्परिभाषित करता है ताकि गहन संपीड़न संभव हो

मल्टीवर्स ने एक पेपर जारी किया है जिसमें एक विधि का विवरण दिया गया है जो बड़े भाषा मॉडल प्रूनिंग को एक बाध्य द्विआधारी अनुकूलन समस्या के रूप में पुनर्परिभाषित करती है और इसे आइसिंग ग्लास पर मैप करती है। ट्रान्सफॉर्मर ब्लॉकों को स्पिन के रूप में मानते हुए, जिसमें हानि हेसियन से व्युत्पन्न युग्मन होते हैं, यह दृष्टिकोण पुनरावृत्ति बेंचमार्किंग की आवश्यकता के बिना इष्टतम ब्लॉक हटाने की विन्यासों की पहचान करता है।

lab Hugging Face Blog · 15 दिन पहले · 20 बार देखा गया

ALTK-Evolve में एजेंट विश्वसनीयता अंतर को आधा करने के लिए सुसंगतता दिशानिर्देश पेश किए गए

शोधकर्ताओं ने ALTK-Evolve सिस्टम के भीतर "सुसंगतता दिशानिर्देश" पेश किए हैं, जो एक नया तंत्र है जिसे मानक औसत सटीकता मापदंड अक्सर छिपा देते हैं, LLM एजेंट प्रदर्शन में परिवर्तनशीलता को संबोधित करने के लिए डिज़ाइन किया गया है। फ्लिप होने वाले निर्णय बिंदुओं की पहचान करके और उन्हें स्थिर करके, यह दृष्टिकोण समग्र क्षमता को त्यागे बिना कार्य सफलता की सुसंगतता में महत्वपूर्ण सुधार करता है।

lab Hugging Face Blog · 16 दिन पहले · 19 बार देखा गया

TRL v1.14 का AsyncGRPOTrainer Hugging Face Jobs में LoRA-मात्र समन्वयन सक्षम करता है

TRL v1.14 ने AsyncGRPOTrainer में LoRA समर्थन पेश किया, जिससे यह एक Low-Rank Adaptation एडेप्टर को प्रशिक्षित कर सकता है और केवल उस छोटे फ़ाइल को vLLM इनफ़रेंस वर्करों पर समन्वयित कर सकता है। यह आर्किटेक्चर एक साझा Storage Bucket को फ़ाइल सिस्टम ब्रिज के रूप में उपयोग करके अलग-अलग मशीनों पर प्रशिक्षण और जनरेटिंग जॉब्स को अलग करता है, जिससे नोड्स के बीच NCCL या सीधे नेटवर्क संचार की आवश्यकता समाप्त हो जाती है।

lab Hugging Face Blog · 20 दिन पहले · 29 बार देखा गया

ग्रैडियो ने Workflow1111 जारी किया, AUTOMATIC1111 की सुविधाओं को ग्रैडियो ग्राफ के रूप में पुनर्निर्मित करते हुए

ग्रैडियो ने Workflow1111 जारी किया है, एक परियोजना जो gr.Workflow फ्रेमवर्क का उपयोग करके AUTOMATIC1111 के stable-diffusion-webui सुविधा सेट का अधिकांश पुनर्निर्माण करती है। इस एप्लिकेशन में सातानवे नोड्स से बने ग्यारह मीडिया पाइपलाइन वाले एकल कैनवास पर शामिल हैं, जिनमें टेक्स्ट-टू-इमेज, इमेज-टू-वीडियो और विभिन्न प्रीप्रोसेसिंग कार्य शामिल हैं।

lab Hugging Face Blog · 21 दिन पहले · 45 बार देखा गया

IBM ने व्यावसायिक-अनुकूल लाइसेंस के साथ SOTA ग्रेनाइट टाइम सीरीज़ पैचTST-FM-r2 मॉडल जारी किया

IBM ने ग्रेनाइट टाइम सीरीज़ पैचTST-FM-r2 जारी किया है, जो एक ~385M-पैरामीटर टाइम सीरीज़ फाउंडेशन मॉडल है जो अनुमतिपूर्ण व्यावसायिक लाइसेंस के तहत GIFT-Eval लीडरबोर्ड पर शीर्ष शून्य-शॉट प्रदर्शन प्राप्त करता है।

lab Hugging Face Blog · 22 दिन पहले · 28 बार देखा गया

बहु-ब्रह्मांड कंप्यूटिंग ने सटीक एलएलएम सुरक्षा अस्वीकृति के लिए सीमा-जागरूक स्व-संक्रमण का प्रस्ताव रखा

एक बहु-ब्रह्मांड कंप्यूटिंग शोधपत्र एक विधि का परिचय देता है जिसमें भाषा मॉडलों को किसी विषय के हानिकारक उपसमुच्चयों को ही अस्वीकार करने के लिए प्रशिक्षित किया जाता है, न कि संपूर्ण श्रेणी को, जो कि मंद विषय-स्तरीय सुरक्षा मार्गदर्शकों की सीमाओं को दूर करता है। यह दृष्टिकोण सुरक्षा बनाए रखते हुए गैर-लाभदायक प्रॉम्प्ट्स पर झूठी अस्वीकृतियों को कम करने के लिए कवरेज मरम्मत और वितरण-अंतर्गत हानिरहित डेटा के साथ सीमा-जागरूक स्व-संक्रमण का उपयोग करता है।

lab Hugging Face Blog · 27 दिन पहले · 37 बार देखा गया

NeoMME ने घने और देर-इंटरैक्शन रीट्रीवल के साथ कुशल बहुआयामी एन्कोडर जारी किए

शोधकर्ताओं ने NeoMME का परिचय दिया, जो 260M और 800M बहुभाषी बहुआयामी एन्कोडर्स का एक परिवार है जो एकल द्विदिशात्मक Transformer का उपयोग करके पाठ और कच्चे छवि पैचों को प्रोसेस करता है। जनरेटिव विज़ुअल लैंग्वेज मॉडल्स के विपरीत, NeoMME अलग-अलग प्रीट्रेन्डेड विज़न टावर या कैज़ुअल डिकोडर्स पर निर्भर नहीं करता है, और पूरे मॉडल को एक मास्क्ड डिस्क्रीट-डिफ्यूजन ऑब्जेक्टिव के साथ शून्य से प्रशिक्षित करता है।

lab Hugging Face Blog · 27 दिन पहले · 66 बार देखा गया

Hugging Face ने कोडिंग एजेंट्स के लिए टिकाऊ, स्थानीय मेमोरी देने के लिए funes जारी किया

Hugging Face ने funes जारी किया है, एक उपकरण जो मौजूदा कोडिंग एजेंट सत्र लॉग्स को Claude Code, Codex, pi, और Hermes के लिए टिकाऊ, खोजने योग्य मेमोरी परत में बदल देता है। यह वेक्टर और BM25 खोज का उपयोग करके स्थानीय रूप से ट्रैस को इंडेक्स करता है, जिससे एजेंट बाहरी सेवाओं के बिना सटीक प्रमाणन पुनः प्राप्त कर सकते हैं।

lab Hugging Face Blog · 27 दिन पहले · 27 बार देखा गया

GRPO के साथ LFM2.5-350M का फाइन-ट्यूनिंग IFStruct स्कीमा अनुपालन को बेहतर बनाता है

एक गाइड GRPO (ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइजेशन) का उपयोग करके Liquid AI LFM2.5-350M मॉडल के फाइन-ट्यूनिंग को प्रदर्शित करता है ताकि संरचित आउटपुट जनरेशन में सुधार किया जा सके। इस प्रक्रिया में NVIDIA Nemotron डेटासेट के एक उपसमुच्चय पर प्रशिक्षण और IFStruct बेंचमार्क के माध्यम से प्रदर्शन का मूल्यांकन शामिल है।