विषय · Reasoning models
lab OpenAI News · 24 दिन पहले · 40 बार देखा गया

तर्कसंगत मॉडलों के विस्तार के साथ OpenAI AI जोखिम की चेतावनी देता है

"एन एलियन माइंड" शीर्षक वाले एक निबंध में, OpenAI तर्कसंगत भाषा मॉडलों में तेजी से होने वाली प्रगति और पुनरावृत्त आत्म-उन्नयन की संभावना पर चर्चा करता है। लेखक ने चिंता व्यक्त की है कि मशीन बुद्धिमत्ता मानवीय क्षमताओं को परिवर्तनीय तरीकों से पार कर रही है, जो मुख्य रूप से गणना शक्ति के विस्तार द्वारा संचालित है न कि डिज़ाइन किए गए एल्गोरिदम द्वारा।

lab NVIDIA Research · 19 दिन पहले · 13 बार देखा गया

ReasAlign तर्क का उपयोग करके LLM एजेंट्स को प्रॉम्प्ट इंजेक्शन से बचाता है

शोधकर्ताओं ने ReasAlign पेश किया है, जो एक मॉडल-स्तर का समाधान है जिसे Large Language Models (LLMs) में अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन हमलों के खिलाफ सुरक्षा संरेखण को बेहतर बनाने के लिए डिज़ाइन किया गया है। इस दृष्टिकोण में उपयोगकर्ता क्वेरी का विश्लेषण करने और विरोधाभासी निर्देशों का पता लगाने के लिए संरचित तर्क चरण शामिल हैं, जिससे उपयोगकर्ता की इच्छित कार्यों की निरंतरता सुनिश्चित होती है।

media Don't Worry About the Vase · 17 दिन पहले · 34 बार देखा गया

OpenAI का आंतरिक मॉडल 88 घंटों में Navier-Stokes समस्या को हल करता है

OpenAI ने Navier-Stokes के फाइन-टाइम ब्लोअप समस्या को हल करने के लिए Astra से शक्तिशाली एक आंतरिक मॉडल का उपयोग किया, जो हज़ार वर्ष की समस्याओं के हल होने की अफवाहों के बाद 88 घंटों में कार्य पूरा कर लिया।

media AI News (smol.ai) · 18 दिन पहले · 31 बार देखा गया

OpenAI का दावा: 10,000-एजेंट सहयोग से AI-सहायित Navier-Stokes सिंगुलैरिटी परिणाम

OpenAI से जुड़े खातों ने बताया कि एक AI-सहायित प्रयास ने Millennium Prize Problems में से एक, Navier-Stokes अस्तित्व और नियमितता समस्या से संबंधित एक परिणाम उत्पन्न किया। इस दावे का केंद्र लगभग 10,000 एजेंटों वाले सहयोगी सिस्टम पर है, जिन्हें मल्टी-एजेंट रिनफोर्समेंट लर्निंग का उपयोग करके एक वर्ष की अवधि में प्रशिक्षित किया गया।

media Ahead of AI · 21 दिन पहले · 31 बार देखा गया

OpenAI ने GPT-6 Astra को मजबूत 3D रेंडरिंग और कंप्यूटर उपयोग के साथ जारी किया

OpenAI ने GPT-6 Astra जारी किया है, एक नया मॉडल जो लेखन, गणित और कोडिंग बेंचमार्क में अपने पूर्ववर्ती GPT-5.6 से काफी बेहतर प्रदर्शन करता है। रिलीज़ में 3D रेंडरिंग, एनिमेशन और ग्राफिकल यूजर इंटरफ़ेस इंटरैक्शन में मॉडल की असाधारण क्षमताओं पर जोर दिया गया है।

arxiv arXiv cs.CL · 2 दिन पहले · 1 बार देखा गया

TokenProbe सटीकता को बनाए रखते हुए CoT टोकन उपयोग को 76% कम करता है

शोधकर्ताओं ने TokenProbe प्रस्तुत किया, जो Chain-of-Thought तर्क के उच्च टोकन उपभोग को हल करने वाले एक फ्रेमवर्क को दर्शाता है, जो तर्क ट्रैस के भीतर टोकन के गैर-समान मूल्य का लाभ उठाता है। विधि सामान्यीकृत लॉग प्रायिकता संकेतों का उपयोग करके निर्णायक सामग्री ले जाने वाले कोर टोकन और अनावश्यक फिलर के बीच अंतर करती है।

arxiv arXiv cs.CL · 8 दिन पहले · 19 बार देखा गया

TelecomGPT-R1: विविध टेलीकॉम कार्यों में तर्क के लिए एकीकृत पोस्ट-ट्रेनिंग

शोधकर्ताओं ने TelecomGPT-R1 का परिचय दिया है, जो एक खुला-स्रोत एकीकृत टेलीकॉम तर्क मॉडल परिवार है, जो मानकों, कॉन्फ़िगरेशन और लॉग पर तर्क करके इंजीनियरिंग कार्यों को स्वचालित करने के लिए डिज़ाइन किया गया है। यह मॉडल प्रोटोकॉल, ज्ञान, मॉडलिंग और दोष अक्षों को कवर करने वाले एक संरचित दृष्टिकोण के माध्यम से मौजूदा सामान्य-उद्देश्य और विशेष LLMs की सीमाओं को दूर करता है।

media Hugging Face Forums · 9 दिन पहले · 14 बार देखा गया

CosmicUndercurrent ने LLM whole-system coordination का परीक्षण करने के लिए Principia-Structurae-Realitatis जारी किया

CosmicUndercurrent ने एक model-agnostic reasoning framework को open-source किया है, जिसका डिज़ाइन यह परीक्षण करने के लिए किया गया है कि क्या structural priming large language models में global inconsistencies को कम कर सकता है। प्रोजेक्ट, hosted, इस बात की जांच करता है कि क्या दो-चरणीय प्रक्रिया local correctness की तुलना में whole-system coordination को बेहतर बनाती है।

media Hugging Face Forums · 10 दिन पहले · 17 बार देखा गया

प्रपोजिशन विघटन और विरोधाभास-चालित तर्क प्रणाली के लिए प्रस्ताव

एक लेखक ने एक ऐसे तर्क प्रणाली के शोध डिज़ाइन का प्रस्ताव दिया है जो दो प्रपोजिशन के बीच विरोधाभासों का पता लगाती है, उन्हें छोटे घटकों में विघटित करके और तार्किक टकराव की खोज करके, सीधे LLM निर्णय पर निर्भर करने के बजाय।

media r/LocalLLaMA · 20 दिन पहले · 43 बार देखा गया

GigaChat ने 432B-A28B MoE तर्क मॉडल को 37% कम टोकन के साथ जारी किया

Sberbank के AI Sage ने GigaChat-3.5 Reasoning जारी किया है, जो लंबे संदर्भ दक्षता के लिए Gated DeltaNet का उपयोग करने वाला 432B-A28B Mixture of Experts (MoE) मॉडल है।

blog Simon Willison · 29 दिन पहले · 46 बार देखा गया

एन्थ्रोपिक ने बेहतर कोडिंग और विज्ञान बेंचमार्क के साथ क्लॉड फेबल 5.1 जारी किया

एन्थ्रोपिक ने क्लॉड फेबल 5.1 जारी किया है, जो कोडिंग, ज्ञान कार्य और लंबे समय तक चलने वाली समस्या-समाधान कार्यों के लिए एक नया मानक स्थापित करने वाला मॉडल अपडेट है। इस रिलीज में नए Terminal-Bench-Science 0.1 बेंचमार्क पर महत्वपूर्ण प्रदर्शन लाभ उजागर हुए हैं, जहाँ फेबल 5.1 ने 52.6% स्कोर हासिल किया, जबकि फेबल 5 के लिए 24.7%, ओपस 5 के लिए 29.0% और जीपीटी-5.6 सोल के लिए 22.4% था।