स्रोत · MarkTechPost
media MarkTechPost · 1 दिन पहले OSWorld 2.0 · 72.6% · 2 बार देखा गया

OpenAI ने लॉन्च किए dots: समर्पित क्लाउड कंप्यूटरों के साथ स्थिर GPT-6 Astra एजेंट्स

OpenAI ने "dots" का परिचय दिया, जो एक नया मैनेज्ड उत्पाद है जिसमें GPT-6 Astra मॉडल द्वारा संचालित स्थिर AI एजेंट्स शामिल हैं। प्रत्येक dot अपने स्वयं के समर्पित क्लाउड कंप्यूटर और ब्राउज़र पर काम करता है, जो इसे ChatGPT प्लगइन्स के माध्यम से 4,000+ एप्लिकेशन में काम करने और उपयोगकर्ता लॉग ऑफ़ करने के बाद भी कार्यों को जारी रखने की अनुमति देता है।

media MarkTechPost · 1 दिन पहले · 4 बार देखा गया

Anthropic ने Claude Sonnet 5.5 को तेज़ गति और कम लागत के साथ जारी किया

Anthropic ने Claude Sonnet 5.5 जारी किया है, जो Claude 5.5 परिवार का दूसरा मॉडल है, जिसे दैनिक कार्यों, बग ठीक करने और दस्तावेज़ पॉलिशिंग के लिए Claude Opus 5.5 के लिए एक तेज़ और अधिक लागत-प्रभावी पूरक के रूप में स्थापित किया गया है।

media MarkTechPost · 8 दिन पहले DeepSWE · 68.8% · 23 बार देखा गया

OpenAI ने 50% कम API मूल्यों के साथ GPT-6 Sol और Luna जारी किए

OpenAI ने दो नए मॉडल, GPT-6 Sol और GPT-6 Luna जारी किए हैं, जो अब OpenAI API में लाइव हैं। ये मॉडल पहले लॉन्च किए गए GPT-6 Astra के नीचे आते हैं और जटिल कोडिंग और उच्च-आयतन वाले दैनिक कार्यों के लिए तेज़, अधिक सुलभ स्तरों तक अपनी तकनीकी प्रगति लाने का लक्ष्य रखते हैं।

media MarkTechPost · 8 दिन पहले · 20 बार देखा गया

Anthropic ने 40% कम लागत पर Fable 5.1 प्रदर्शन के साथ Claude Opus 5.5 जारी किया

Anthropic ने Claude Opus 5.5 जारी किया है, जो अपने नए Claude 5.5 परिवार का पहला मॉडल है, जो अधिकांश कार्य में Claude Fable 5.1 के स्तर पर प्रदर्शन करता है और Opus 5 की तुलना में चलाने की लागत 40% कम है।

media MarkTechPost · 8 दिन पहले GDPval-AA (Elo) · 1695.0Elo · 23 बार देखा गया

SpaceXAI ने बड़े बेस मॉडल और सुधारे गए बेंचमार्क्स के साथ Grok 4.7 जारी किया

SpaceXAI ने Grok 4.7 जारी किया है, जो कोडिंग, एजेंटिक कार्यों और ज्ञान कार्य के लिए एक नया फ्लैगशिप मॉडल है जो Grok 4.6 की तुलना में बड़े बेस मॉडल और विस्तारित रीइंफोर्समेंट लर्निंग रन का उपयोग करता है। मॉडल अपने पूर्ववर्ती के समान ही मूल्य निर्धारण संरचना बनाए रखता है, जबकि स्व-सत्यापन, लंबे संदर्भ हैंडलिंग और सुरक्षा में बढ़ी हुई क्षमताएं प्रदान करता है।

media MarkTechPost · 12 दिन पहले · 35 बार देखा गया

अलibaba ने Qwen3.8-Omni-Flash जारी किया, जो एजेंटिक ओमनी-मोडल मॉडल है जिसमें 1M संदर्भ है

अलibaba की Qwen टीम ने Qwen3.8-Omni-Flash जारी किया है, जो ऑडियो-वीडियो समझ और टूल उपयोग के लिए एजेंटिक क्षमताओं के आसपास डिज़ाइन किया गया उनका पहला ओमनी-मोडल मॉडल है। मॉडल टेक्स्ट, छवियों, ऑडियो और वीडियो इनपुट स्वीकार करता है ताकि टेक्स्ट आउटपुट वापस ला सके, जिसमें 1M-टोकन संदर्भ विंडो और नेटिव फंक्शन कॉलिंग शामिल हैं।

media MarkTechPost · 15 दिन पहले · 27 बार देखा गया

Google ने उत्पादन वॉइस एजेंट्स के लिए Gemini 3.8 Live और Extended Thinking जारी किया

Google ने Gemini 3.8 Live और Gemini 3.8 Live Extended Thinking पेश किए हैं, जो वास्तविक समय के वॉइस एजेंट्स के लिए डिज़ाइन किए गए नेटिव स्पीच-टू-स्पीच मॉडल हैं, जो संवाद की प्रवाह को बिना तोड़े तर्क करते हैं और टूल्स का निष्पादन करते हैं।

media MarkTechPost · 17 दिन पहले · 40 बार देखा गया

एन्थ्रोपिक ने एम्बेडेड इवैल्यूएटर्स के साथ 'पेस द फ्रंटियर' योजना का प्रस्ताव रखा

12 सितंबर 2026 को, एन्थ्रोपिक के सीईओ डारियो अमोदेई ने 'हमें फ्रंटियर को गति देना चाहिए' शीर्षक से एक निबंध प्रकाशित किया, जिसमें AI क्षमता में सुधार की गति रोकने का आह्वान किया गया। इस प्रस्ताव में तीन-चरणों वाली योजना शामिल है: ट्रेनिंग पाइपलाइन तक कर्मचारी-स्तर की पहुँल वाले तृतीय-पक्ष 'एम्बेडेड इवैल्यूएटर्स' स्थापित करना, फ्रंटियर लैब्स के बीच सुरक्षा मानकों का समन्वय करना, और AI सीमाओं पर वैश्विक समझौतों की ओर बढ़ना।

media MarkTechPost · 20 दिन पहले · 55 बार देखा गया

DeepSeek ने 1M संदर्भ और FP4 KV कैश के साथ DeepSeek-V4.1-Flash जारी किया

DeepSeek AI ने DeepSeek-V4.1-Flash जारी किया है, जो एक बहुमोडल मिक्स्चर-ऑफ-एक्सपर्ट्स मॉडल है जिसमें 1-मिलियन-टोकन संदर्भ विंडो और FP4 KV कैश शामिल है जो प्रति टोकन 890 बाइट के वैश्विक कैश फुटप्रिंट को कम करता है। मॉडल एक कारणवादी एन्कोडर-डीकोडर आर्किटेक्चर और कॉम्प्रेस्ड स्पार्स एटेंशन 2 (CSA2) का उपयोग करता है जो प्रदर्शन बनाए रखते हुए मेमोरी की आवश्यकताओं को काफी कम करता है।

media MarkTechPost · 27 दिन पहले ARC-AGI 3 · 99.9% · 59 बार देखा गया

OpenAI ने GPT-6 Astra जारी किया, जो 1.05M संदर्भ के साथ एक कंप्यूटर-उपयोग मॉडल है

OpenAI ने GPT-6 Astra जारी किया है, जो एक बंद और होस्टेड मॉडल है जिसे मुख्य रूप से चैट मॉडल के बजाय एक कंप्यूटर-उपयोग प्रणाली के रूप में स्थित किया गया है। यह ब्राउज़रों, स्प्रेडशीट्स और टर्मिनल्स में सॉफ़्टवेयर को संचालित करता है ताकि बहु-चरण वाले कार्यों को पूरा किया जा सके, जिसमें 1,050,000-टोकन संदर्भ विंडो और 30 अप्रैल, 2026 तक की ज्ञान कटऑफ़ शामिल है।

media MarkTechPost · 27 दिन पहले GDPval-AA (Elo) · 1754.0Elo · 52 बार देखा गया

Meta ने Muse Spark 1.3 जारी किया है जिसमें कम टूल कॉल और टोकन हैं

Meta Superintelligence Labs ने Muse Spark 1.3 जारी किया है, जो एक एजेंटिक कोडिंग मॉडल है जो लंबे समय तक चलने वाले वर्कफ़्लो के लिए डिज़ाइन किया गया है, न कि सिंगल-टर्न जनरेशन के लिए। अपडेट अब Muse Code और Meta Model API में उपलब्ध है, जिसमें 1M टोकन संदर्भ विंडो है जबकि वजन बंद रखा गया है।

media MarkTechPost · 28 दिन पहले · 63 बार देखा गया

Google DeepMind ने Gemini 3.8 Flash और gated Flash Cyber संस्करण जारी किए

Google DeepMind ने दो नए मॉडल संस्करण, Gemini 3.8 Flash और Gemini 3.8 Flash Cyber जारी किए हैं, जो एक मौलिक आर्किटेक्चर साझा करते हैं लेकिन सुरक्षा एन्वेलप और एक्सेस नियंत्रण में भिन्न हैं। मानक Gemini 3.8 Flash Gemini API और अन्य Google प्लेटफ़ॉर्म के माध्यम से सामान्य रूप से उपलब्ध है, जबकि Cyber संस्करण Fairwind प्रोग्राम के माध्यम से सत्यापित रक्षकों तक सीमित है।

media MarkTechPost · 29 दिन पहले GDPval-AA (Elo) · 1853.0Elo · 53 बार देखा गया

Anthropic ने Claude Fable 5.1 को Terminal-Bench-Science पर 52.6% और सस्ते कैश रीड के साथ जारी किया

Anthropic ने Claude Fable 5.1 और प्रतिबंधित Claude Mythos 5.1 जारी किए हैं, दोनों एक ही अंतर्निहित मॉडल साझा करते हैं लेकिन सुरक्षा परतों में भिन्न होते हैं। Fable 5.1 प्रमुख क्लाउड प्रदाताओं के लिए सामान्य रूप से उपलब्ध है, जबकि Mythos 5.1 केवल सत्यापित संगठनों तक सीमित है।

media MarkTechPost · 7 घंटे पहले

NVIDIA के शोधकर्ताओं ने Cosmos 3 वीडियो मॉडल में भौतिक तर्क को बेहतर बनाने के लिए Physis-Lang जारी किया

NVIDIA, MIT और ऑक्सफोर्ड विश्वविद्यालय के शोधकर्ताओं ने Physis-Lang पेश किया है, एक फ्रेमवर्क जो कैप्शन में स्व-विकासशील भौतिक भाषा को एकीकृत करके वीडियो वर्ल्ड मॉडल को बढ़ावा देता है। यह दृष्टिकोण भौतिक भाषा को डेटा चयन, मॉडल प्रशिक्षण और उत्पन्न वीडियों में भौतिक त्रुटियों को ठीक करने के लिए उपयोग की जाने वाली एक अनुकूलनीय निरूपण के रूप में मानता है।

media MarkTechPost · 7 घंटे पहले · 4 बार देखा गया

Perplexity ने Photon जारी किया, पुनर्प्राप्ति की p99 विलंबता को 800 ms से घटाकर 65 ms कर दिया

Perplexity ने Photon जारी किया है, एक आंतरिक Rust-आधारित पुनर्प्राप्ति और रैंकिंग इंजन जो अब सभी उत्पादन ट्रैफिक संभाल रहा है, जिसने पहले फोर्क किए गए ओपन-सोर्स घटक को प्रतिस्थापित किया है। नया सिस्टम Perplexity Search API में एक "Fast Search" मोड सक्षम करता है, जो एजेंटिक वर्कफ़्लो के लिए काफी कम विलंबता प्रदान करता है।

media MarkTechPost · 13 घंटे पहले · 3 बार देखा गया

Liquid AI ने d1 जारी किया, एक निर्णय मॉडल जो शून्य आउटपुट टोकन के साथ संतुलित प्रायिकताएं लौटाता है

Liquid AI ने d1 जारी किया है, एक निर्णय मॉडल जिसे पाठ उत्पादन के बजाय संरचित चयनों के लिए डिज़ाइन किया गया है। यह संदर्भ और टाइप किए गए प्रश्न स्वीकार करता है, और शून्य उत्पन्न आउटपुट टोकन के साथ एक ही कॉल में निश्चित परिणामों पर संतुलित प्रायिकताएं लौटाता है।

media MarkTechPost · 1 दिन पहले Android World · 85.1% · 8 बार देखा गया

H कंपनी ने डेस्कटॉप, वेब और मोबाइल के लिए Holo4 ओपन-वेट कंप्यूटर-यूज़ मॉडल जारी किए

H कंपनी ने Holo4 जारी किया है, जो एक सामान्यीकृत कंप्यूटर-यूज़ विजन-लैंग्वेज मॉडल परिवार है जिसे डेस्कटॉप, वेब, Android और API वातावरण में क्लिक करने, टाइप करने, कोड लिखने और टूल्स को कॉल करने के लिए डिज़ाइन किया गया है। रिलीज में दो मॉडल आकार शामिल हैं: Holo4 27B (dense) और Holo4 35B-A3B (Mixture of Experts with 3B active parameters), दोनों 256K context window का समर्थन करते हैं।

media MarkTechPost · 1 दिन पहले SWE-bench Verified · 79.0% · 7 बार देखा गया

AI एजेंट हार्नेस ओवरफिटिंग को रोकने के लिए Google Research ने RRSI जारी किया

Google Cloud AI Research, UNC-Chapel Hill, Stanford और Washington University in St. Louis के सहयोग से, RRSI (Regularized Recursive Self-Improvement) को ओपन-सोर्स कर चुका है। यह फ्रेमवर्क एक LLM एजेंट को मॉडल वेट्स को बदले बिना अपने हार्नेस—जिसमें प्रॉम्प्ट्स, टूल्स, मेमोरी, कंट्रोल फ्लो और सब-एजेंट शामिल हैं—को पुनः लिखने की अनुमति देता है।

media MarkTechPost · 1 दिन पहले · 3 बार देखा गया

अलibaba क्वेन ने क्वेन-ऑडियो-3.1-रियलटाइम फुल-डप्लेक्स वॉइस मॉडल जारी किया

अलibaba के क्वेन टीम ने क्वेन-ऑडियो-3.1 जारी किया है, जो एक पांच-मॉडल ऑडियो स्टैक है जिसमें नया क्वेन-ऑडियो-3.1-रियलटाइम-प्लस शामिल है, जो वॉइस एजेंट्स के लिए डिज़ाइन किया गया एक फुल-डप्लेक्स स्पीच मॉडल है जो तर्क और टूल उपयोग की क्षमता रखता है। इस रिलीज़ में ASR सेवाओं पर 95% तक की कीमत में कमी भी शामिल है।

media MarkTechPost · 2 दिन पहले · 9 बार देखा गया

NVIDIA ने OpenShell और Sentry के साथ ओपन एजेंट सेफ्टी प्लेटफॉर्म लॉन्च किया

NVIDIA ने NVIDIA Open Agent Safety Platform लॉन्च किया है, जो AI एजेंट सुरक्षा के लिए एक ओपन सॉफ़्टवेयर प्लेटफॉर्म है जो OpenShell सुरक्षित रनटाइम को Sentry के साथ जोड़ता है, जो BlueField-4 DPUs पर आउट-ऑफ़-बैंड वॉचडॉग है। सिस्टम "ड्रिफ्ट" नामक विफलता मोड को रोकने के लिए डिज़ाइन किया गया है, जहां एजेंट एप्लिकेशन-स्तरीय नियंत्रणों को पार कर जाते हैं, सुरक्षा प्रवर्तन को एजेंट की पहुंच से बाहर रखकर।