Reasoning models
arxiv arXiv cs.CL · 7 घंटे पहले · 11 बार देखा गया

TelecomGPT-R1: विविध टेलीकॉम कार्यों में तर्क के लिए एकीकृत पोस्ट-ट्रेनिंग

शोधकर्ताओं ने TelecomGPT-R1 का परिचय दिया है, जो एक खुला-स्रोत एकीकृत टेलीकॉम तर्क मॉडल परिवार है, जो मानकों, कॉन्फ़िगरेशन और लॉग पर तर्क करके इंजीनियरिंग कार्यों को स्वचालित करने के लिए डिज़ाइन किया गया है। यह मॉडल प्रोटोकॉल, ज्ञान, मॉडलिंग और दोष अक्षों को कवर करने वाले एक संरचित दृष्टिकोण के माध्यम से मौजूदा सामान्य-उद्देश्य और विशेष LLMs की सीमाओं को दूर करता है।

media Hugging Face Forums · 1 दिन पहले · 10 बार देखा गया

CosmicUndercurrent ने LLM whole-system coordination का परीक्षण करने के लिए Principia-Structurae-Realitatis जारी किया

CosmicUndercurrent ने एक model-agnostic reasoning framework को open-source किया है, जिसका डिज़ाइन यह परीक्षण करने के लिए किया गया है कि क्या structural priming large language models में global inconsistencies को कम कर सकता है। प्रोजेक्ट, hosted, इस बात की जांच करता है कि क्या दो-चरणीय प्रक्रिया local correctness की तुलना में whole-system coordination को बेहतर बनाती है।

media Hugging Face Forums · 2 दिन पहले · 15 बार देखा गया

प्रपोजिशन विघटन और विरोधाभास-चालित तर्क प्रणाली के लिए प्रस्ताव

एक लेखक ने एक ऐसे तर्क प्रणाली के शोध डिज़ाइन का प्रस्ताव दिया है जो दो प्रपोजिशन के बीच विरोधाभासों का पता लगाती है, उन्हें छोटे घटकों में विघटित करके और तार्किक टकराव की खोज करके, सीधे LLM निर्णय पर निर्भर करने के बजाय।

media Don't Worry About the Vase · 10 दिन पहले · 29 बार देखा गया

OpenAI का आंतरिक मॉडल 88 घंटों में Navier-Stokes समस्या को हल करता है

OpenAI ने Navier-Stokes के फाइन-टाइम ब्लोअप समस्या को हल करने के लिए Astra से शक्तिशाली एक आंतरिक मॉडल का उपयोग किया, जो हज़ार वर्ष की समस्याओं के हल होने की अफवाहों के बाद 88 घंटों में कार्य पूरा कर लिया।

media AI News (smol.ai) · 10 दिन पहले · 26 बार देखा गया

OpenAI का दावा: 10,000-एजेंट सहयोग से AI-सहायित Navier-Stokes सिंगुलैरिटी परिणाम

OpenAI से जुड़े खातों ने बताया कि एक AI-सहायित प्रयास ने Millennium Prize Problems में से एक, Navier-Stokes अस्तित्व और नियमितता समस्या से संबंधित एक परिणाम उत्पन्न किया। इस दावे का केंद्र लगभग 10,000 एजेंटों वाले सहयोगी सिस्टम पर है, जिन्हें मल्टी-एजेंट रिनफोर्समेंट लर्निंग का उपयोग करके एक वर्ष की अवधि में प्रशिक्षित किया गया।

lab NVIDIA Research · 12 दिन पहले · 12 बार देखा गया

ReasAlign तर्क का उपयोग करके LLM एजेंट्स को प्रॉम्प्ट इंजेक्शन से बचाता है

शोधकर्ताओं ने ReasAlign पेश किया है, जो एक मॉडल-स्तर का समाधान है जिसे Large Language Models (LLMs) में अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन हमलों के खिलाफ सुरक्षा संरेखण को बेहतर बनाने के लिए डिज़ाइन किया गया है। इस दृष्टिकोण में उपयोगकर्ता क्वेरी का विश्लेषण करने और विरोधाभासी निर्देशों का पता लगाने के लिए संरचित तर्क चरण शामिल हैं, जिससे उपयोगकर्ता की इच्छित कार्यों की निरंतरता सुनिश्चित होती है।

media r/LocalLLaMA · 13 दिन पहले · 39 बार देखा गया

GigaChat ने 432B-A28B MoE तर्क मॉडल को 37% कम टोकन के साथ जारी किया

Sberbank के AI Sage ने GigaChat-3.5 Reasoning जारी किया है, जो लंबे संदर्भ दक्षता के लिए Gated DeltaNet का उपयोग करने वाला 432B-A28B Mixture of Experts (MoE) मॉडल है।

media Ahead of AI · 14 दिन पहले · 28 बार देखा गया

OpenAI ने GPT-6 Astra को मजबूत 3D रेंडरिंग और कंप्यूटर उपयोग के साथ जारी किया

OpenAI ने GPT-6 Astra जारी किया है, एक नया मॉडल जो लेखन, गणित और कोडिंग बेंचमार्क में अपने पूर्ववर्ती GPT-5.6 से काफी बेहतर प्रदर्शन करता है। रिलीज़ में 3D रेंडरिंग, एनिमेशन और ग्राफिकल यूजर इंटरफ़ेस इंटरैक्शन में मॉडल की असाधारण क्षमताओं पर जोर दिया गया है।

lab OpenAI News · 17 दिन पहले · 34 बार देखा गया

तर्कसंगत मॉडलों के विस्तार के साथ OpenAI AI जोखिम की चेतावनी देता है

"एन एलियन माइंड" शीर्षक वाले एक निबंध में, OpenAI तर्कसंगत भाषा मॉडलों में तेजी से होने वाली प्रगति और पुनरावृत्त आत्म-उन्नयन की संभावना पर चर्चा करता है। लेखक ने चिंता व्यक्त की है कि मशीन बुद्धिमत्ता मानवीय क्षमताओं को परिवर्तनीय तरीकों से पार कर रही है, जो मुख्य रूप से गणना शक्ति के विस्तार द्वारा संचालित है न कि डिज़ाइन किए गए एल्गोरिदम द्वारा।

blog Simon Willison · 21 दिन पहले · 40 बार देखा गया

एन्थ्रोपिक ने बेहतर कोडिंग और विज्ञान बेंचमार्क के साथ क्लॉड फेबल 5.1 जारी किया

एन्थ्रोपिक ने क्लॉड फेबल 5.1 जारी किया है, जो कोडिंग, ज्ञान कार्य और लंबे समय तक चलने वाली समस्या-समाधान कार्यों के लिए एक नया मानक स्थापित करने वाला मॉडल अपडेट है। इस रिलीज में नए Terminal-Bench-Science 0.1 बेंचमार्क पर महत्वपूर्ण प्रदर्शन लाभ उजागर हुए हैं, जहाँ फेबल 5.1 ने 52.6% स्कोर हासिल किया, जबकि फेबल 5 के लिए 24.7%, ओपस 5 के लिए 29.0% और जीपीटी-5.6 सोल के लिए 22.4% था।

media Hugging Face Forums · 22 दिन पहले · 30 बार देखा गया

AMD RX 7900 XT पर Qwen 3.8 27B xhigh तर्क प्रोफ़ाइल 90°C तक बनाए रखती है

एक उपयोगकर्ता ने OpenCode का उपयोग करके व्यापक कोडिंग कार्यों के लिए UD-Q5_K_M GGUF क्वांटाइजेशन और xhigh तर्क प्रयास प्रोफ़ाइल के साथ Qwen 3.8 27B मॉडल चलाने की रिपोर्ट की है।

blog Simon Willison · 24 दिन पहले · 43 बार देखा गया

Tencent ने Hy4 Preview जारी किया, 1M संदर्भ के साथ 770B टेक्स्ट-ओनली LLM

चीनी कंपनी Tencent ने Hy4 Preview जारी किया है, जो एक ओपन-वेटेड टेक्स्ट इनपुट लार्ज लैंग्वेज मॉडल है जिसमें 770 बिलियन कुल पैरामीटर और 49 बिलियन सक्रिय पैरामीटर हैं। यह रिलीज जुलाई के पिछले Hy3 मॉडल से काफी विस्तार करती है, जिसमें 295B कुल पैरामीटर और 256,000 टोकन संदर्भ खिड़की थी।

media r/LocalLLaMA · 29 दिन पहले · 59 बार देखा गया

IBM ने बिल्ट-इन चेन-ऑफ़-थॉट तर्क के साथ Granite 4.2 परिवार जारी किया

IBM ने ओपन-सोर्स रीजनिंग मॉडल का ग्रैनाइट 4.2 परिवार जारी किया है, जिसमें फ्लैगशिप 30B, मिड-साइज़ 8B और कॉम्पैक्ट 3B वेरिएंट शामिल हैं। ये मॉडल गणित, कोडिंग और जटिल बहु-चरण वाली समस्याओं पर प्रदर्शन में सुधार के लिए नेटिव चेन-ऑफ़-थॉट क्षमताओं का उपयोग करते हैं।