विषय · Research paper
lab Google DeepMind Blog · 8 दिन पहले · 27 बार देखा गया

चक्रवात पूर्वानुमान के लिए Google DeepMind ने WeatherNext AI मॉडल को ओपन सोर्स किया

Google DeepMind और Google Research ने WeatherNext 2 और WeatherNext Cyclones AI मॉडल को ओपन सोर्स किया है, जो उष्णकटिबंधीय चक्रवात के मार्ग, तीव्रता और वायु संरचना की भविष्यवाणी में शीर्ष स्तर की सटीकता हासिल करते हैं। Nature में प्रकाशित इस कार्य से पता चलता है कि ये मॉडल पूर्वानुमानकों को पिछले सिस्टम की तुलना में भविष्यवाणी की सटीकता में एक दिन का अतिरिक्त लाभ प्रदान करते हैं।

lab OpenAI News · 14 दिन पहले · 23 बार देखा गया

Astra मॉडल गणित और सैद्धांतिक कंप्यूटर विज्ञान में दस खुली समस्याओं को हल करता है

OpenAI का आंतरिक Astra मॉडल गणित और सैद्धांतिक कंप्यूटर विज्ञान में लंबे समय से चली आ रही दस खुली समस्याओं के समाधान उत्पन्न कर चुका है, जिनके तर्क Lean में औपचारिक रूप दिए गए हैं। ये परिण उच्च-आयामी ज्यामिति, कोडिंग सिद्धांत, समूह सिद्धांत और क्वांटम जटिलता को शामिल करते हैं, उन प्रश्नों को संबोधित करते हैं जिनमें कम से कम एक दशक से कोई प्रगति नहीं हुई थी।

lab NVIDIA Research · 5 घंटे पहले · 1 बार देखा गया

HorizonRelight लंबी अवधि के वीडियो रिलाइटिंग के लिए मस्क्ड सेल्फ-कंडीशनिंग का उपयोग करता है

शोधकर्ताओं ने कार्य को समय-शर्तित लैटेंट डोमेन अनुवाद के रूप में फिर से परिभाषित करके लंबी अवधि के वीडियो रिलाइटिंग में कालिक असंततताओं को संबोधित किया। फ्रेमवर्क सीमाओं पर लक्ष्य-डोमेन लैटेंट को प्रसारित करके क्रॉस-चंक निरंतरता को लागू करता है और इस व्यवहार को सीखने योग्य बनाने के लिए मस्क्ड लक्ष्य-डोमेन सेल्फ-कंडीशनिंग का उपयोग करता है।

lab NVIDIA Research · 3 दिन पहले · 38 बार देखा गया

LLM हाइपरपैरामीटर ऑप्टिमाइज़ेशन में बेयसियन ऑप्टिमाइज़ेशन के बराबर या बेहतर हैं

एक नई शोध पत्र मौलिक बड़े भाषा मॉडलों (LLM) का उपयोग हाइपरपैरामीटर ऑप्टिमाइज़ेशन (HPO) को स्वचालित करने के लिए करता है, जो एक प्रक्रिया है जो आमतौर पर सीमित-बजट सेटिंग्स में मानव दृष्टिकोणों पर निर्भर करती है। लेखकों ने एक विधि विकसित की जहाँ LLM डेटासेट और मॉडल के विवरण के आधार पर हाइपरपैरामीटर कॉन्फ़िगरेशन सुझाते हैं, जिन्हें मॉडल के प्रदर्शन के अनुसार पुनः परिष्कृत किया जाता है।

lab NVIDIA Research · 3 दिन पहले · 40 बार देखा गया

स्रोत प्रशिक्षण डेटा एट्रिब्यूशन के लिए अनुमानित अनरोल्ड डिफरेंशिएशन पेश करता है

शोधकर्ताओं ने स्रोत पेश किया, जो एक नया प्रशिक्षण डेटा एट्रिब्यूशन (TDA) विधि है जो प्रभाव फलनों की कंप्यूटेशनल दक्षता को अनरोलिंग-आधारित दृष्टिकोणों की सटीकता के साथ जोड़ती है। प्रभाव-फलन जैसी सूत्र का उपयोग करके अनरोल्ड डिफरेंशिएशन को अनुमानित करने द्वारा, स्रोत अंतर्निहित डिफरेंशिएशन विधियों में सीमाओं को दूर करता है, जैसे कि उनका ऑप्टिमाइजेशन बायस या बहु-चरण पाइलाइन को ध्यान में न रखना।

lab NVIDIA Research · 3 दिन पहले · 10 बार देखा गया

स्वचालित वाहन सिमुलेशन के लिए NVIDIA ने OmniDreams रियल-टाइम जनरेटिव वर्ल्ड मॉडल जारी किया

NVIDIA ने OmniDreams का परिचय दिया, जो एक फाउंडेशन जनरेटिव वर्ल्ड मॉडल है जिसे बंद-लूप सिमुलेशन में स्वचालित ड्राइविंग पॉलिसी के मूल्यांकन में आने वाली बाधाओं को दूर करने के लिए डिज़ाइन किया गया है। Cosmos diffusion मॉडल पर 21k घंटे के ड्राइविंग परिदृश्यों से मिड- और पोस्ट-ट्रेन किए जाने के बाद, यह रियल-टाइम में एक्शन-कंडीश्न्ड वीडियो ऑटोरेग्रेसिवली जनरेट करता है।

lab NVIDIA Research · 3 दिन पहले · 9 बार देखा गया

JacNet संरचित जैकोबियन को सीधे मॉडल करके फ़ंक्शंस सीखता है

पत्र में JacNet का परिचय दिया गया है, जो एक तंत्रिका नेटवर्क आर्किटेक्चर है जो इनपुट-आउटपुट फ़ंक्शन के जैकोबियन को सीधे सीखता है, न कि मैपिंग को। यह दृष्टिकोण अवकलज गुणों पर सटीक नियंत्रण की अनुमति देता है, जिससे व्युत्क्रमणीयता और k-Lipschitz निरंतरता जैसे संरचनात्मक पूर्वज्ञान को लागू करने की सुविधा मिलती है।

lab Microsoft Research Blog · 3 दिन पहले · 11 बार देखा गया

माइक्रोसॉफ्ट रिसर्च ने CARE-X पेश किया, एक एकीकृत छाती की एक्स-रे VLM जिसमें सहायक निगरानी और उपकरण-संवर्धित माप शामिल हैं

माइक्रोसॉफ्ट रिसर्च ने CARE-X का परिचय दिया है, जो एक शोध मॉडल है जिसे वर्तमान रेडियोलॉजी विज़न-लैंग्वेज मॉडल्स में अंतराल को दूर करने के लिए जनरेटिव रिपोर्ट लेखन और कैलिब्रेटेड निदान भविष्यवाणियों को जोड़कर डिज़ाइन किया गया है। सिस्टम क्लिनिकल सटीकता को पुरस्कृत करने के लिए रीइन्फोर्समेंट लर्निंग (DAPO) का उपयोग करता है और Qwen3-VL-4B-Instruct मॉडल को निर्धारक माप उपकरणों के साथ जोड़ता है ताकि सटीक गणनाओं की आवश्यकता वाली स्थितियों पर प्रदर्शन का आकलन किया जा सके।

lab NVIDIA Research · 4 दिन पहले · 6 बार देखा गया

Masters मास्किंग टीचर और स्टूडेंट को रिइन्फोर्सिंग के जरिए विजन-लैंग्वेज मॉडल्स को डिस्टिल करता है

शोधकर्ताओं ने Masters प्रस्तावित किया, जो बड़े पैमाने पर विजन-लैंग्वेज मॉडल्स को एज डेप्लॉयमेंट के लिए उपयुक्त कॉम्पैक्ट संस्करणों में डिस्टिल करने के लिए एक मास्क-प्रोग्रेसिव रिइन्फोर्समेंट लर्निंग फ्रेमवर्क है। विधि टीचर और स्टूडेंट मॉडल्स के बीच आकार अंतर से उत्पन्न अस्थिरता को संबोधित करती है।

lab NVIDIA Research · 4 दिन पहले · 14 बार देखा गया

DSTP जटिल MLLM तर्क में दृश्य टोकन प्रूनिंग विफलताओं को कम करता है

शोधकर्ताओं ने डिकोडिंग के दौरान प्रासंगिक दृश्य जानकारी शिफ्ट (RVIS) को बहुआयामी बड़े भाषा मॉडलों (MLLMs) में मौजूदा दृश्य टोकन प्रूनिंग विधियों की विफलता का मुख्य कारण पहचाना। इसका समाधान करने के लिए, वे डिकोडिंग-स्टेज शिफ्ट-अवेयर टोकन प्रूनिंग (DSTP) का प्रस्ताव करते हैं, जो एक ट्रेनिंग-फ्री फ्रेमवर्क है जो दृश्य टोकनों को बदलते तर्क आवश्यकताओं के साथ संरेखित करता है।

lab NVIDIA Research · 4 दिन पहले · 3 बार देखा गया

GenRecal पुनः कैलिब्रेशन के माध्यम से बड़े विज़न-लैंग्वेज मॉडलों को छोटे मॉडलों में डिस्टिल करता है

शोधकर्ताओं ने GenRecal प्रस्तुत किया, एक सामान्य उद्देश्य वाला डिस्टिलेशन फ्रेमवर्क जो बड़े विज़न-लैंग्वेज मॉडलों (VLMs) से ज्ञान को छोटे और अधिक कुशल प्रतिरूपों में स्थानांतरित करता है। यह विधि एक Recalibrator का उपयोग करके विभिन्न प्रकार के मॉडलों के बीच फीचर प्रतिनिधित्वों को संरेखित और अनुकूलित करके विषम VLM आर्किटेक्चर की चुनौती को संबोधित करता है।

lab NVIDIA Research · 4 दिन पहले · 9 बार देखा गया

ZPPO छोटे विज़न-लैंग्वेज मॉडल प्रशिक्षण को बेहतर बनाने के लिए ग्रेडिएंट के बजाय प्रॉम्प्ट का उपयोग करता है

शोधकर्ताओं ने ज़ोन ऑफ़ प्रोक्सिमल पॉलिसी ऑप्टिमाइज़ेशन (ZPPO) का परिचय दिया, एक विधि जो ज्ञान विलयन में भंगुरता और पुनर्बल सीखने में विचलन को दूर करने के लिए शिक्षक के ज्ञान को पॉलिसी ग्रेडिएंट के बजाय प्रॉम्प्ट में डालती है। ZPPO कठिन प्रश्नों के लिए बाइनरी उम्मीदवार-सहित प्रश्न (BCQ) और नकारात्मक उम्मीदवार-सहित प्रश्न (NCQ) बनाता है, और जब तक छात्र की सटीकता में सुधार नहीं होता या उन्हें निकाला नहीं जाता, तब तक उन्हें रीप्ले बफ़र के माध्यम से पुनः परिसंचारित करता है।

lab NVIDIA Research · 4 दिन पहले

Hide to See ने VLM डिस्टिलेशन के लिए तर्क-पूर्वअक्षर मास्किंग पेश की

शोधकर्ताओं ने एक नया सोच-जवाब डिस्टिलेशन फ्रेमवर्क प्रस्तावित किया है जो संपादित दृश्य-भाषा मॉडल की दृश्य साक्ष्य का उपयोग करने की क्षमता को महत्वपूर्ण तर्क-पूर्वअक्षरों को मास्क करके सुधारता है। यह दृष्टिकोण लंबे सोच-जवाब ट्रैकों में सामान्य "दृश्य भूल" समस्या को संबोधित करता है, जहां छात्र विस्तृत तर्क के दौरान दृश्य संकेतों पर ध्यान खो देते हैं।

lab NVIDIA Research · 4 दिन पहले · 1 बार देखा गया

SpatialClaw एजेंटिक स्थानिक तर्क के लिए क्रिया इंटरफ़ेस के रूप में कोड का उपयोग करता है

शोधकर्ता SpatialClaw का प्रस्ताव करते हैं, एक ट्रेनिंग-मुक्त फ्रेमवर्क जो दृश्य-भाषा मॉडल में खुले-अंत 3D और 4D स्थानिक तर्क को सुधारने के लिए क्रिया इंटरफ़ेस के रूप में कोड अपनाता है। मौजूदा एजेंट्स के विपरीत जो सिंगल-पास एक्जीक्यूशन या रिजिड टूल कॉल्स पर निर्भर करते हैं, SpatialClaw इनपुट फ्रेम्स और परसेप्शन प्रिमिटिव्स से पूर्व-लोडेड एक स्टेटफुल Python kernel बनाए रखता है।

lab NVIDIA Research · 4 दिन पहले · 2 बार देखा गया

AXPO ने थिंकिंग-एक्टिंग गैप को ठीक करके मल्टीमोडल एजेंटिक रीजनिंग में सुधार किया

शोधकर्ताओं ने दृश्य-भाषा मॉडलों में "थिंकिंग-एक्टिंग गैप" को संबोधित करने के लिए एजेंट एक्सप्लोरेटिव पॉलिसी ऑप्टिमाइज़ेशन (AXPO) का प्रस्ताव दिया है, जिन्हें बाहरी उपकरणों की आवश्यकता होती है। यह गैप GRPO जैसे मानक RL विधियों को केवल ~30% रोलआउट्स पर उपकरण उपयोग करने के लिए प्रेरित करता है, जिसमें उच्च विफलता दरें सीखने के संकेतों को दबा देती हैं।

lab NVIDIA Research · 9 दिन पहले · 11 बार देखा गया

ROSA साझा GPU-पूल सर्विंग के माध्यम से कार्यात्मक उत्पादकता को 12.06x तक बढ़ाता है

शोधकर्ताओं ने ROSA का प्रस्ताव रखा, जो एक रोबोटिक्स फाउंडेशन मॉडल सर्विंग सिस्टम है जो रोबोट कारखानों के लिए डिज़ाइन किया गया है और जो एकल-रोबोट, एज-कंप्यूटिंग मान्यताओं से परे जाता है। यह सिस्टम साझा GPU-पूल सर्विंग का उपयोग करता है ताकि रोबोटों के बेड़े नेटवर्क के माध्यम से सर्वर-क्लास GPUs तक पहुंच सकें।

lab NVIDIA Research · 18 दिन पहले · 7 बार देखा गया

Delta Force में अकथित संचार का मल्टीमोडल AI विश्लेषण

शोधकर्ता प्रतिस्पर्धी शूटर गेम Delta Force के gameplay वीडियो का विश्लेषण कर रहे हैं ताकि उत्पन्न होने वाले अकथित संचार, जैसेgestures और movement patterns को निकाला और समझा जा सके। यह कार्य उन पूर्व अध्ययनों में एक अंतराल को दूर करता है जो मुख्य रूप से MOBA गेम्स या अन्य shooters में verbal coordination पर केंद्रित रहे हैं।

lab NVIDIA Research · 18 दिन पहले · 1 बार देखा गया

NVIDIA के शोधकर्ता Rocket League टूर्नामेंट में फील्ड एक्सपेरिमेंट का प्रस्ताव रखते हैं

NVIDIA के शोधकर्ता प्रतिस्पर्धी ग्रुप प्ले की शेड्यूलिंग और लैब वातावरण को पुनः बनाने की कठिनाई को हल करने के लिए फील्ड एक्सपेरिमेंट मेथडोलॉजी अपना रहे हैं। यह दृष्टिकोण प्रयोगों को टूर्नामेंट संरचनाओं में सीधे एकीकृत करता है, जिससे हाइब्रिड टूर्नामेंट-एक्सपेरिमेंट बनते हैं।

lab NVIDIA Research · 21 दिन पहले · 1 बार देखा गया

AITE फ्रेमवर्क LLM-संचालित खोज के माध्यम से वायरलेस एल्गोरिदम स्वतः खोजता है

शोधकर्ताओं ने The AI Telco Engineer (AITE) पेश किया, एक फ्रेमवर्क जो बड़े भाषा मॉडल-संचालित विकासवादी खोज का उपयोग जटिल संचार समस्याओं के लिए एल्गोरिदम को स्वतः डिजाइन करने के लिए करता है, जबकि प्रदर्शन-जटिलता के बीच समझौतों से निपटता है।

media Don't Worry About the Vase · 11 दिन पहले · 5 बार देखा गया

OpenAI का Astra गणित के 10 प्रमुख खुले समस्याओं को हल करता है

OpenAI ने अपने अनाधिकृत आंतरिक मॉडल, Astra से परिणाम जारी किए हैं, जिसने गणित में दस महत्वपूर्ण खुली समस्याओं को सफलतापूर्वक हल किया। समाधान मॉडल द्वारा उत्पन्न किए गए और बाद में मानव शोधकर्ताओं द्वारा Lean प्रमाण पत्रों में औपचारिक रूप दिया गया।