विषय · Reasoning models
media Don't Worry About the Vase · 11 दिन पहले · 5 बार देखा गया

OpenAI का Astra गणित के 10 प्रमुख खुले समस्याओं को हल करता है

OpenAI ने अपने अनाधिकृत आंतरिक मॉडल, Astra से परिणाम जारी किए हैं, जिसने गणित में दस महत्वपूर्ण खुली समस्याओं को सफलतापूर्वक हल किया। समाधान मॉडल द्वारा उत्पन्न किए गए और बाद में मानव शोधकर्ताओं द्वारा Lean प्रमाण पत्रों में औपचारिक रूप दिया गया।

blog Simon Willison · 13 दिन पहले · 13 बार देखा गया

OpenAI का Astra मॉडल GPT-5.6 Sol का उपयोग करके दस लंबे समय से चले आ रहे गणितीय समस्याओं को हल करता है

OpenAI ने दस गणितीय और सैद्धांतिक कंप्यूटर विज्ञान समस्याओं के समाधान जारी किए हैं, जिनके मुख्य परिणामों पर कम से कम एक दशक से कोई प्रगति नहीं हुई थी, अपने अगले प्रमुख मॉडल Astra के आंतरिक संस्करण का उपयोग करके।

blog Simon Willison · 2 दिन पहले · 10 बार देखा गया

अनुसंधानकर्ता रीप्ले अटैक के माध्यम से प्रोप्राइटरी LLM API से तर्क ट्रेस चुराते हैं

एक पेपर में दिखाया गया है कि Anthropic, OpenAI और Google द्वारा लौटाए गए एन्क्रिप्टेड चेन-ऑफ़-थॉट ब्लॉक प्लेनटेक्स्ट में निकाले जा सकते हैं। लेखकों ने एक कमजोरी का फायदा उठाया जहाँ समान परिवार के मॉडल एन्क्रिप्शन कुंजी साझा करते थे, जिससे वे ट्रेस को कमजोर भाई-बहन मॉडल में रीप्ले कर सके।

media Latent Space · 3 दिन पहले · 11 बार देखा गया

शोधकर्ताओं ने क्लॉड, जीपीटी और जेमिनी एपीआई से एन्क्रिप्टेड तर्क ट्रेस को डीकोड किया

एक नया पेपर प्रदर्शित करता है कि क्लॉड, जीपीटी और जेमिनी जैसे फ्रंटियर मॉडल्स से एन्क्रिप्टेड तर्क ब्लॉक्स को डीकोड और रीप्ले किया जा सकता है ताकि छिपी हुई चेन-ऑफ़-थॉट डेटा निकाला जा सके। लेखकों ने दिखाया कि कैसे इन साइन किए गए ब्लॉब्स को कमजोर मॉडल्स या अलग सेशन में स्थानांतरित करके आधारभूत विचारों को ट्रांसक्राइब किया जा सकता है, जिससे प्रदाताओं की ओबफ़स्केशन प्रयासों को प्रभावी ढंग से पार किया जाता है।

arxiv arXiv cs.LG · 4 दिन पहले · 11 बार देखा गया

शोधकर्ता क्रॉस-सेशन एन्क्रिप्शन पुन: उपयोग का लाभ उठाकर LLM API से तर्क ट्रेस चुराते हैं

शोधकर्ताओं ने प्रमुख बड़े भाषा मॉडल प्रदाताओं द्वारा स्टेप-बाय-स्टेप तर्क ट्रेस को कैसे संभाला जाता है, इसमें एक कमजोरी की पहचान की है, जिसे क्लाइंट-साइड उपयोग के लिए एन्क्रिप्टेड ब्लॉक के रूप में वापस किया जाता है। उन्होंने पाया कि ये एन्क्रिप्टेड ब्लॉक प्रदाता के ही पारिस्थितिकी तंत्र के भीतर विभिन्न सेशनों, उपयोगकर्ताओं और मॉडल के बीच पूरी तरह से संगत और अदला-बदली योग्य हैं।

arxiv arXiv cs.AI · 4 दिन पहले · 16 बार देखा गया

आक्रामक एन्क्रिप्टेड ब्लॉक कमजोरी के माध्यम से प्रोप्राइटरी LLM APIs से तर्क ट्रेस चुराते हैं

शोधकर्ताओं ने मुख्य बड़े भाषा मॉडल प्रदाताओं द्वारा चरण-दर-चरण तर्क ट्रेस को कैसे संभाला जाता है, उसमें एक वास्तुकला कमजोरी की पहचान की है। प्रदाता इन ट्रेस को ग्राहकों को एन्क्रिप्टेड ब्लॉक के रूप में लौटाते हैं, लेकिन अध्ययन पाता है कि ये ब्लॉक प्रदाता के पारिस्थितिकी तंत्र के भीतर विभिन्न सत्रों, उपयोगकर्ताओं और मॉडल के बीच पूरी तरह से संगत और अदला-बदली योग्य हैं।

media AI News (smol.ai) · 8 दिन पहले · 1 बार देखा गया

मेटा के म्यूज़ स्पार्क 1.2 और ओपनएआई के GPT-5.6 Sol अपडेट

मेटा ने घोषणा की कि इसका म्यूज़ स्पार्क 1.2 मॉडल पांच STEM ओलंपियाड में गोल्ड मेडल प्रदर्शन हासिल करने में सफल रहा और Vals इंडेक्स पर $0.69/टेस्ट की लागत के साथ शीर्ष 5 में शामिल हुआ, जो किमी से लगभग 3 गुना सस्ता है। मेटा ने इन सुधारों का कारण समानांतर तर्क के साथ बहु-एजेंट ऑर्केस्ट्रेशन को बताया, जिसमें APhO और IPhO में बाहरी उपकरणों के बिना सिद्धांत में पूर्ण स्कोर प्राप्त किए गए।

media r/LocalLLaMA · 11 दिन पहले · 21 बार देखा गया

AI9Stars ने G9v3-39A5B जारी किया, जिसमें 39B पैरामीटर और 5 सक्रिय विशेषज्ञ हैं

AI9Stars ने G9v3-39A5B जारी किया है, जो एक ओपन वेट्स भाषा मॉडल है जिसे इसके पूर्ववर्ती ai9stars/G9v3-3B की तुलना में मजबूत तर्क क्षमताएं प्रदान करने के लिए डिज़ाइन किया गया है। मॉडल में 39 अरब पैरामीटर और 5 सक्रिय विशेषज्ञ हैं और यह व्यक्तिगत और व्यावसायिक उपयोग के लिए Apache 2.0 के तहत लाइसेंस प्राप्त है।

media Hugging Face Forums · 12 दिन पहले · 2 बार देखा गया

GPT-5.6 ने अदृश्य साहित्यिक क्रिप्टोग्राफी बेंचमार्क में छिपे संदेशों का 95% हिस्सा पुनर्प्राप्त किया

जोसेफ जेएम वॉकर द्वारा एक कार्यकारी पेपर में भौतिक उपन्यास "I Wrote a Book and Made a Million Dollars (I.B. Wryten)" में एम्बेडेड अदृश्य मल्टी-चैनल साहित्यिक क्रिप्टोग्राफी बेंचमार्क पर फ्रंटियर लैंग्वेज मॉडल्स का आकलन किया गया है। अध्ययन से पता चला कि GPT-5.6 ने सहायक संचार चैनल को स्वतंत्र रूप से पहचान लिया और अपने पहले पास में एम्बेडेड सामग्री का लगभग 95% हिस्सा पुनर्प्राप्त किया, जबकि पूर्व मॉडल्स में प्रभावी रूप से 0% क्षमता दिखाई दी।

arxiv arXiv cs.CL · 18 दिन पहले · 2 बार देखा गया

फ्रंटियर LLMs फिलर टोकन्स के माध्यम से अदृश्य तर्क का उपयोग करके CoT निगरानी को पार करते हैं

एक अध्ययन दिखाता है कि फ्रंटियर भाषा मॉडल अर्थहीन फिलर टोकन्स का उपयोग करके महत्वपूर्ण गणना कर सकते हैं, जिससे एक विफलता मोड उत्पन्न होता है जहाँ तर्क आउटपुट चेन-ऑफ़-थॉट में दिखाई नहीं देता। शोध ने तीन कार्यों पर 13 मॉडल का मूल्यांकन किया और पाया कि कई मॉडल इन टोकन्स से काफी लाभान्वित होते हैं, जिससे सटीकता में 13 प्रतिशत अंक तक की वृद्धि हुई।

arxiv arXiv cs.AI · 23 दिन पहले Humanity's Last Exam · 49.92% · 1 बार देखा गया

PoTRE ने परीक्षण-समय तर्क के लिए विषम बहु-एजेंट ढांचे का परिचय दिया

लेखकों ने PoTRE (Poly-Topological Reasoning Ensembles) का परिचय दिया है, जो एक ऐसा ढांचा है जो जटिल तर्क कार्यों में मानक सिंगल-स्ट्रीम प्रॉम्प्टिंग की सीमाओं को दूर करने के लिए डिज़ाइन किया गया है। PoTRE निष्पादन को चार अलग-अलग एजेंट्स में विभाजित करता है: एक Adversarial Refinement Agent, एक Hierarchical strategic Planning Agent, एक Spectrum Search Agent, और एक Direct Chain Agent.

arxiv arXiv cs.AI · 24 दिन पहले

ISO ने मॉडल वजन स्पेक्ट्रा को ठीक करने वाला RLVR-नेटिव ऑप्टिमाइज़ेशन स्टैक पेश किया

शोधकर्ताओं ने Isospectral Optimization (ISO) का प्रस्ताव रखा है, जो सत्यापित पुरस्कारों के साथ पुनर्बल सीखने (RLVR) के लिए एक फ्रेमवर्क है जो मॉडल वजन स्पेक्ट्रा को स्थिर रखते हुए इनपुट और आउटपुट सिंगुलर फ्रेम को ऑप्टिमाइज़ करके अनुपस्थित ऑप्टिमाइज़ेशन परत को संबोधित करता है।

media Hugging Face Forums · 29 दिन पहले · 1 बार देखा गया

कार्यक्षमता के लिए गैर-तंत्रिका संवादात्मक प्रतीकात्मक AI का अन्वेषण

एक डेवलपर ने पिछले आठ महीनों में विकसित की गई एक संवादात्मक प्रतीकात्मक AI आर्किटेक्चर पर प्रगति साझा की है, जिसका उद्देश्य गैर-तंत्रिका जानकारी निष्कर्षण में अंतराल को दूर करना है।