लैब · NVIDIA
lab NVIDIA Research · 5 घंटे पहले · 1 बार देखा गया

HorizonRelight लंबी अवधि के वीडियो रिलाइटिंग के लिए मस्क्ड सेल्फ-कंडीशनिंग का उपयोग करता है

शोधकर्ताओं ने कार्य को समय-शर्तित लैटेंट डोमेन अनुवाद के रूप में फिर से परिभाषित करके लंबी अवधि के वीडियो रिलाइटिंग में कालिक असंततताओं को संबोधित किया। फ्रेमवर्क सीमाओं पर लक्ष्य-डोमेन लैटेंट को प्रसारित करके क्रॉस-चंक निरंतरता को लागू करता है और इस व्यवहार को सीखने योग्य बनाने के लिए मस्क्ड लक्ष्य-डोमेन सेल्फ-कंडीशनिंग का उपयोग करता है।

lab NVIDIA Research · 5 घंटे पहले · 2 बार देखा गया

Nvidia ने हाइब्रिड डोमेन नॉलेज फ्यूजन के माध्यम से रियल-टाइम पोर्ट्रेट रिलिटिंग के लिए FusionRelight प्रस्तुत किया

Nvidia के शोधकर्ताओं ने FusionRelight पेश किया है, जो एक विधि है जो भौतिक रूप से युक्तिसंगत प्रकाश स्थानांतरण को पहचान संरक्षण और संपीड़ित रियल-टाइम इनफरेंस के साथ जोड़ती है। यह दृष्टिकोण हाइब्रिड डोमेन नॉलेज फ्यूजन (HDKF) का उपयोग करता है, एक प्रशिक्षण ढांचा जो सिंथेटिक, वन-लाइट-एट-ए-टाइम (OLAT), और इन-द-वाइल्ड डेटा से भौतिकी, प्रतिबिंब और यथार्थता के पूर्वज्ञान को एक छात्र मॉडल में संक्षिप्त करता है।

lab NVIDIA Research · 3 दिन पहले · 10 बार देखा गया

स्वचालित वाहन सिमुलेशन के लिए NVIDIA ने OmniDreams रियल-टाइम जनरेटिव वर्ल्ड मॉडल जारी किया

NVIDIA ने OmniDreams का परिचय दिया, जो एक फाउंडेशन जनरेटिव वर्ल्ड मॉडल है जिसे बंद-लूप सिमुलेशन में स्वचालित ड्राइविंग पॉलिसी के मूल्यांकन में आने वाली बाधाओं को दूर करने के लिए डिज़ाइन किया गया है। Cosmos diffusion मॉडल पर 21k घंटे के ड्राइविंग परिदृश्यों से मिड- और पोस्ट-ट्रेन किए जाने के बाद, यह रियल-टाइम में एक्शन-कंडीश्न्ड वीडियो ऑटोरेग्रेसिवली जनरेट करता है।

lab NVIDIA Research · 18 दिन पहले · 9 बार देखा गया

NVIDIA ने मल्टीमोडल मॉडल के स्थानिक तर्क के लिए एक पदानुक्रमित निदान ढांचा Spatial-IQ का परिचय दिया

NVIDIA के शोधकर्ताओं ने Spatial-IQ का परिचय दिया है, जो मल्टीमोडल लार्ज लैंग्वेज मॉडल्स (MLLMs) की स्थानिक बुद्धिमत्ता को तोड़ने के लिए डिज़ाइन किया गया एक निदान ढांचा है। मौजूदा बेंचमार्क्स के विपरीत जो मॉडल्स को ब्लैक बॉक्स के रूप में मानते हैं, यह दृष्टिकोण स्टैक्ड 3D संरचनाओं में वस्तु गिनती को मानव विकास चरणों से सुसंगत नौ संवेदी और संज्ञानात्मक उप-कार्यों में विभाजित करता है।

lab NVIDIA Research · 18 दिन पहले · 13 बार देखा गया

2D गॉसियन-आधारित छवि संपीड़न के लिए क्लस्टर कोडबुक क्वांटीकरण

शोधकर्ता Cluster-Guided Vector Quantization (CGVQ) प्रस्तुत करते हैं, जो गॉसियन प्राइमिटिव-आधारित छवि संपीड़न में दर-विकृति प्रदर्शन को बेहतर बनाने के लिए डिज़ाइन किया गया एक विधि है। दृष्टिकोण क्वांटीकरण से पहले गॉसियन पैरामीटर को समजात समूहों में विभाजित करता है, जिसमें प्रति प्राइमिटिव बड़ी संख्या में फ्लोटिंग-पॉइंट पैरामीटर संग्रहीत करने के कारण होने वाली अक्षमता को दूर किया जाता है।

lab NVIDIA Research · 18 दिन पहले · 7 बार देखा गया

Delta Force में अकथित संचार का मल्टीमोडल AI विश्लेषण

शोधकर्ता प्रतिस्पर्धी शूटर गेम Delta Force के gameplay वीडियो का विश्लेषण कर रहे हैं ताकि उत्पन्न होने वाले अकथित संचार, जैसेgestures और movement patterns को निकाला और समझा जा सके। यह कार्य उन पूर्व अध्ययनों में एक अंतराल को दूर करता है जो मुख्य रूप से MOBA गेम्स या अन्य shooters में verbal coordination पर केंद्रित रहे हैं।

lab NVIDIA Research · 18 दिन पहले · 1 बार देखा गया

NVIDIA के शोधकर्ता Rocket League टूर्नामेंट में फील्ड एक्सपेरिमेंट का प्रस्ताव रखते हैं

NVIDIA के शोधकर्ता प्रतिस्पर्धी ग्रुप प्ले की शेड्यूलिंग और लैब वातावरण को पुनः बनाने की कठिनाई को हल करने के लिए फील्ड एक्सपेरिमेंट मेथडोलॉजी अपना रहे हैं। यह दृष्टिकोण प्रयोगों को टूर्नामेंट संरचनाओं में सीधे एकीकृत करता है, जिससे हाइब्रिड टूर्नामेंट-एक्सपेरिमेंट बनते हैं।

lab NVIDIA Research · 21 दिन पहले · 1 बार देखा गया

AITE फ्रेमवर्क LLM-संचालित खोज के माध्यम से वायरलेस एल्गोरिदम स्वतः खोजता है

शोधकर्ताओं ने The AI Telco Engineer (AITE) पेश किया, एक फ्रेमवर्क जो बड़े भाषा मॉडल-संचालित विकासवादी खोज का उपयोग जटिल संचार समस्याओं के लिए एल्गोरिदम को स्वतः डिजाइन करने के लिए करता है, जबकि प्रदर्शन-जटिलता के बीच समझौतों से निपटता है।

lab NVIDIA Research · 23 दिन पहले · 1 बार देखा गया

NVIDIA ने गेम्स में नियंत्रणीय जनरेटिव ग्राफिक्स के लिए CTRL-G पेश किया

NVIDIA ने CTRL-G (Controllable Generative Graphics for Games) पेश किया है, जो इंटरैक्टिव गेम वातावरण के भीतर जनरेटिव AI सिस्टम को नियंत्रित करने की चुनौती को संबोधित करने के लिए डिज़ाइन किया गया एक फ्रेमवर्क है।

media TLDR AI · 18 दिन पहले · 5 बार देखा गया

Anthropic ने Claude Opus 5 जारी किया; NVIDIA खुले-वजन नीतियों की मांग करती है

Anthropic ने Claude Opus 5 को एक अधिक कुशल मॉडल के रूप में पेश किया जो आधे दाम पर Claude Fable 5 की क्षमताओं के करीब पहुंचता है, और Claude Max के लिए डिफ़ॉल्ट बन गया। इसी बीच, NVIDIA नवाचार को बढ़ावा देने और क्षेत्र में अमेरिकी प्रमुखता को मजबूत करने के लिए खुले-वजन AI मॉडलों का समर्थन करने वाली अमेरिकी सरकार की नीतियों के लिए अभियान चला रही है।

lab Hugging Face Blog · 25 दिन पहले · 1 बार देखा गया

NVIDIA ने Cosmos 3 Edge जारी किया, एक 4B-पैरामीटर मॉडल जो एज डिवाइसों पर रियल-टाइम रोबोट नियंत्रण के लिए है

NVIDIA ने Cosmos 3 Edge जारी किया है, जो एक 4-अरब-पैरामीटर ओपन वर्ल्ड मॉडल है जिसे मेमोरी-सीमित एज सिस्टम पर डेटा सेंटर-स्तर का प्रदर्शन प्रदान करने के लिए डिज़ाइन किया गया है। यह मॉडल रोबोटों और विजन AI एजेंट्स को अपने आसपास के वातावरण को समझने, रियल-टाइम में तर्क करने और NVIDIA Jetson मॉड्यूल जैसे डिवाइसों पर सीधे एक्शन जनरेट करने में सक्षम बनाता है।

lab Hugging Face Blog · 29 दिन पहले · 8 बार देखा गया

NVIDIA ने RTEB पर #1 स्थान हासिल करने वाले Nemotron 3 Embed मॉडल जारी किए

NVIDIA ने Nemotron 3 Embed जारी किया है, जो उत्पादन-स्तर के RAG, एजेंटिक रीट्रीवल, कोड रीट्रीवल और एजेंट मेमोरी के लिए रीट्रीवल गुणवत्ता को बेहतर बनाने के लिए डिज़ाइन किए गए खुले और वाणिज्यिक रूप से उपलब्ध एम्बेडिंग मॉडल का एक संग्रह है। इस संग्रह में 8B का एक मॉडल शामिल है जो RTEB लीडरबोर्ड पर समग्र रूप से #1 स्थान पर है, इसके अलावा डेप्लॉयमेंट के लिए अनुकूलित कुशल 1B वेरिएंट भी हैं।

github llama.cpp · 1 दिन पहले

llama.cpp के OpenVINO बैकएंड में Qwen3.5 समर्थन और मेमोरी अनुकूलन शामिल

llama.cpp परियोजना ने अपने OpenVINO बैकएंड में महत्वपूर्ण अपडेट मर्ज किए हैं, जिनमें मुख्य रूप से Qwen3.5 मॉडल परिवार के लिए समर्थन सक्षम किया गया है और कई मेमोरी अनुकूलन तकनीकों को पेश किया गया है।

lab NVIDIA Technical Blog · 2 दिन पहले · 5 बार देखा गया

अलibaba ने NVIDIA GB300 NVL72 के लिए Qwen3.8-2.4T-A95B ओपन वेट्स जारी किए

अलibaba ने अपने सबसे बड़े ओपन-वेट मॉडल Qwen3.8-2.4T-A95B (जिसे Qwen3.8-Max के रूप में भी जाना जाता है) के लिए ओपन वेट्स जारी किए हैं, जिसे ओपन एकोसिस्टम में न्यूनतम सीमा की क्षमताएं लाने के लिए डिज़ाइन किया गया है।

media MarkTechPost · 3 दिन पहले · 1 बार देखा गया

NVIDIA ने Nemotron 3.5 Lightning मॉडल और NeMo Switchyard राउटर जारी किए

NVIDIA ने हमेशा-सक्रिय AI एजेंट्स बनाने के लिए डिज़ाइन किए गए दो ओपन-सोर्स आर्टिफैक्ट जारी किए हैं: Nemotron 3.5 Lightning मॉडल और NeMo Switchyard राउटिंग लाइब्रेरी। ये टूल्स लंबे समय तक चलने वाले एजेंट वर्कफ़्लो के हर चरण को फ्रंटियर रीज़निंग मॉडल में भेजने की उच्च लागत और लेटेन्सी को विशेष निष्पादन और राउटिंग क्षमताएं प्रदान करके दूर करते हैं।

lab Hugging Face Blog · 4 दिन पहले · 8 बार देखा गया

NVIDIA Magpie TTS में अरबी, कोरियाई, पुर्तगाली जोड़े गए और गुणवत्ता में सुधार

NVIDIA ने अपने Magpie Multilingual TTS मॉडल में एक अपडेट जारी किया है, जिसमें आधुनिक मानक अरबी, कोरियाई और ब्राज़ीलियन पुर्तगाली के जुड़ने के साथ दस भाषाओं का समर्थन बढ़ाकर बारह कर दिया गया है। इस रिलीज में अपडेटेड ट्रेनिंग डेटा और आर्किटेक्चरल बदलावों के माध्यम से मौजूदा भाषाओं में गुणवत्ता में भी सुधार शामिल है।

lab NVIDIA Technical Blog · 4 दिन पहले · 8 बार देखा गया

Meta ने स्थानीय एजेंटिक AI के लिए 30B ओपन-वेट मॉडल Muse Glimmer जारी किया

Meta ने स्थानीय AI एजेंटिक कार्य के लिए डिज़ाइन किए गए 120K+ संदर्भ विंडो वाले 30B घनत्वपूर्ण मॉडल Muse Glimmer को जारी किया है। NVIDIA edge, डेस्कटॉप और वर्कस्टेशन प्लेटफ़ॉर्म पर चलने के लिए अनुकूलित, यह मॉडल एकल GPU पर 20K टोकन/सेक प्रदान करता है।

media MarkTechPost · 5 दिन पहले · 13 बार देखा गया

NVIDIA ने NemotronLabs VoiceChat 11B जारी किया, जो ~450 ms टर्न-टेकिंग के साथ एक खुला फुल-डप्लेक्स स्पीच-टू-स्पीच मॉडल है

NVIDIA ने NemotronLabs VoiceChat 11B जारी किया है, जो रियल-टाइम, फुल-डप्लेक्स संवाद के लिए डिज़ाइन किया गया एक खुला 11B पैरामीटर एंड-टू-एंड स्पीच-टू-स्पीच मॉडल है। कैस्केडेड स्टैक के विपरीत जो ASR, LLM, और TTS को चेन करते हैं, यह यूनिफाइड नेटवर्क एक साथ स्ट्रीमिंग स्पीच समझ और जनरेशन करता है, जिसने Full-Duplex-Bench 1.0 पर मापा गया स्मूथ टर्न-टेकिंग लेटेंसी 448 ms प्राप्त किया।

media MarkTechPost · 7 दिन पहले · 5 बार देखा गया

NVIDIA ने AI एजेंट्स बनाने के लिए एक ऑब्जेक्ट-ओरिएंटेड Python फ्रेमवर्क NOOA जारी किया

NVIDIA Labs ने NOOA (NVIDIA Object-Oriented Agents) को ओपन-सोर्स कर दिया है, जो एक मॉडल-अग्नोस्टिक Python फ्रेमवर्क है जो एजेंट विकास को एकल Python क्लास में समेटता है। यह दृष्टिकोण प्रॉम्प्ट टेम्पलेट्स और वर्कफ्लो ग्राफ्स वाले बिखरे हुए वर्कफ्लोज को प्रतिस्थापित करता है, जिसमें विधियों को एक्शन, फील्ड्स को स्टेट, डॉकस्ट्रिंग्स को प्रॉम्प्ट्स, और टाइप एनोटेशन को लागू अनुबंधों में मैप किया जाता है।