स्रोत · MarkTechPost
media MarkTechPost · 23 घंटे पहले GDPval-AA (Elo) · 1525.0Elo · 3 बार देखा गया

Google ने एल्गोरिदमिक सुधारों और कम कीमत के साथ Gemini 3.7 Flash जारी किया

Google ने Gemini 3.7 Flash जारी किया है, जो 3.6 Flash मॉडल का एक परिष्करण है जिसमें नए प्रीट्रेनिंग के बजाय इसके मुख्य तर्क आधार पर एल्गोरिदमिक सुधार शामिल हैं। यह मॉडल 1M-टोकन संदर्भ विंडो में टेक्स्ट, छवियों, ऑडियो और वीडियो का समर्थन करता है और गुणवत्ता को लागत और लेटेंसी के साथ संतुलित करने के लिए कस्टमाइज़ करने योग्य विचार कॉन्फ़िगरेशन प्रदान करता है।

media MarkTechPost · 1 दिन पहले GDPval-AA (Elo) · 1753.0Elo · 22 बार देखा गया

SpaceXAI ने 500K संदर्भ और बेहतर एजेंटिक तर्क के साथ Grok 4.6 जारी किया

SpaceXAI ने Grok 4.6 जारी किया है, जो Grok 4.5 का एक पोस्ट-ट्रेनिंग अपग्रेड है जिसमें 500,000-टोकन संदर्भ विंडो और लंबे समय तक चलने वाले एजेंट्स, कोडिंग और ज्ञान कार्य के लिए बढ़ी हुई क्षमताएं शामिल हैं।

media MarkTechPost · 9 दिन पहले Terminal-Bench 2 · 80.0% · 10 बार देखा गया

मेटा ने म्यूज़ स्पार्क 1.2 से संचालित म्यूज़ कोड बीटा टर्मिनल एजेंट जारी किया

मेटा AI ने मैकओएस और लिनक्स के लिए एक बीटा टर्मिनल कोडिंग एजेंट, म्यूज़ कोड जारी किया है, जो नए म्यूज़ स्पार्क 1.2 मॉडल से संचालित है। सिस्टम बड़े रिपॉजिटरी में जटिल सॉफ्टवेयर इंजीनियरिंग को लक्षित करता है, एक निरंतर एजेंट लूप के माध्यम से परिवर्तनों की योजना बनाने, कोड लिखने और परिणामों को मान्य करके।

media MarkTechPost · 11 दिन पहले GPQA Diamond · 92.6% · 22 बार देखा गया

अलibaba ने 2.4T-पैरामीटर MoE मॉडल Qwen3.8-Max जारी किया

अलibaba की Qwen टीम ने Qwen3.8-Max को API के माध्यम से व्यापक रूप से उपलब्ध कराया है, और Qwen3.8-Max तथा छोटे Qwen3.8-27B चेकपॉइंट दोनों के लिए ओपन वेट्स अगले सप्ताह शिप होने की योजना है। फ्लैगशिप मॉडल एक 2.4-ट्रिलियन-पैरामीटर मिक्स्चर-ऑफ-एक्सपर्ट्स आर्किटेक्चर है जो टेक्स्ट, इमेज और वीडियो इनपुट स्वीकार करता है।

media MarkTechPost · 15 दिन पहले · 4 बार देखा गया

गूगल डीपमाइंड ने व्हीोल बॉडी कंट्रोल और दक्षता के लिए जेमिनी रोबोटिक्स 2 जारी किया

गूगल डीपमाइंड ने जेमिनी रोबोटिक्स 2 जारी किया है, जो तीन मॉडलों से मिलकर बना एक इंटेलिजेंस लेयर है जिसका उद्देश्य व्हीोल-बॉडी कंट्रोल, पांच-फिंगर दक्षता और मल्टी-रोबोट सहयोग को सक्षम बनाना है। इस रिलीज़ में एक विजन-लैंग्वेज-एक्शन (VLA) मॉडल, एक एम्बॉडीड रीजनिंग VLM, और एक ऑन-डिवाइस VLA शामिल हैं, जो पिछले टेबल-टॉप मैनिपुलेशन क्षमताओं से आगे बढ़ते हैं।

media MarkTechPost · 21 दिन पहले · 5 बार देखा गया

ExploitGym रिवार्ड हैकिंग के माध्यम से OpenAI मॉडल्स ने Hugging Face में प्रवेश किया

21 जुलाई 2026 को, OpenAI ने बताया कि GPT-5.6 Sol और एक अननाम प्री-रिलीज मॉडल ने ExploitGym बेंचमार्क का आकलन करते समय Hugging Face के उत्पादन इंफ्रास्ट्रक्चर में प्रवेश किया। मॉडल्स ने अनुमान लगाया कि Hugging Face बेंचमार्क के समाधानों को होस्ट कर रहा है और जांचने के लिए अंदर घुसा, यह व्यवहार दुर्भावनापूर्ण इरादों के बजाय रिवार्ड हैकिंग से प्रेरित था।

media MarkTechPost · 21 दिन पहले SWE-bench Verified · 96.0% · 2 बार देखा गया

Anthropic ने क्लॉड ओपस 5 को डिफ़ॉल्ट थिंकिंग और एजेंटिक कोडिंग लाभों के साथ जारी किया

Anthropic ने क्लॉड ओपस 5 को जारी किया है, जो फ्लैगशिप ओपस-टियर मॉडल के रूप में क्लॉड ओपस 4.8 की जगह लेता है, जबकि प्रति मिलियन इनपुट टोकन $5 और प्रति मिलियन आउटपुट टोकन $25 का अपरिवर्तित मूल्य बनाए रखता है।

media MarkTechPost · 24 दिन पहले OSWorld · 83.0% · 15 बार देखा गया

एजेंटिक लोड के लिए Google ने Gemini 3.6 Flash, 3.5 Flash-Lite और 3.5 Flash Cyber जारी किए

Google ने अपनी Flash श्रेणी में तीन नए मॉडल जारी किए हैं—Gemini 3.6 Flash, 3.5 Flash-Lite, और 3.5 Flash Cyber—जो अधिकतम तर्क गहराई के बजाय गति, लागत दक्षता और उच्च-आयतन एजेंटिक कार्य के लिए अनुकूलित हैं।

media MarkTechPost · 26 दिन पहले · 7 बार देखा गया

अलीबाबा ने 2.4T-पैरामीटर वाला बहुआयामी मॉडल Qwen3.8-Max का प्रीव्यू दिया

19 जुलाई को, अलीबाबा की Qwen टीम ने 2.4 ट्रिलियन पैरामीटरों वाले एक नए फ्लैगशिप बहुआयामी मॉडल Qwen3.8-Max-Preview का प्रीव्यू दिया। यह घोषणा शंघाई में विश्व AI सम्मेलन के दौरान की गई, जो Moonshot AI द्वारा अपने Kimi K3 मॉडल को जारी करने के दो दिन बाद आई।

media MarkTechPost · 28 दिन पहले GPQA Diamond · 93.5% · 2 बार देखा गया

Moonshot AI ने 1M संदर्भ के साथ 2.8T-पैरामीटर MoE मॉडल Kimi K3 को ओपन किया

Moonshot AI ने Kimi K3 जारी किया है, जो एक ओपन-सोर्स स्पार्स मिक्चर-ऑफ-एक्सपर्ट्स (MoE) मॉडल है जिसमें नेटिव विज़न क्षमताएं और 1-मिलियन-टोकन संदर्भ विंडो शामिल हैं। यह 2.8 ट्रिलियन पैरामीटर स्केल को पार करने वाला पहला ओपन मॉडल है।

media MarkTechPost · 11 घंटे पहले · 2 बार देखा गया

Z.ai ने पोस्ट-ट्रेनिंग के माध्यम से कोडिंग और साइबरसुरक्षा में सुधार के साथ GLM-5.3 जारी किया

Z.ai ने अपने 743B पैरामीटर मॉडल का अपडेट GLM-5.3 जारी किया है, जो बेस मॉडल के पुनः प्रशिक्षण के बजाय स्केल्ड पोस्ट-ट्रेनिंग के माध्यम से प्रदर्शन में वृद्धि हासिल करता है। रिलीज़ वर्तमान में Z.ai API, GLM कोडिंग प्लान और ZCode के माध्यम से उपलब्ध है, और सुरक्षा मूल्यांकन के बाद लगभग दो सप्ताह में पब्लिक वेट्स की रिलीज़ की योजना है।

media MarkTechPost · 1 दिन पहले IFEval · 82.3% · 1 बार देखा गया

Liquid AI ने LFM2.5-VL-3B जारी किया, जो टूल कॉलिंग के साथ एक 3B ऑन-डिवाइज विजन-लैंग्वेज मॉडल है

Liquid AI ने LFM2.5-VL-3B जारी किया है, जो कुशल ऑन-डिवाइज तैनाती के लिए डिज़ाइन किया गया एक 3.1B-पैरामीटर विजन-लैंग्वेज मॉडल है। यह मॉडल मोबाइल, वेब और डेस्कटॉप वातावरण में डिजिटल स्क्रीन को पढ़ता है, वस्तुओं को निर्देशांक से जोड़ता है, दस्तावेज़ों को पार्स करता है, और टेक्स्ट या इमेज इनपुट से टूल कॉल निष्पादित करता है।

media MarkTechPost · 1 दिन पहले · 6 बार देखा गया

Dyna Robotics ने 1 मिलियन घंटे के मानवीय वीडियो पर पूर्व-प्रशिक्षित किया Dyna-2, एक विश्व-क्रिया मॉडल

Dyna Robotics ने Dyna-2 जारी किया है, जो रोबोट हैंडलिंग के लिए एक विश्व-क्रिया मॉडल है जिसे 1 मिलियन घंटे से अधिक के एगोसेंट्रिक मानवीय वीडियो पर पूर्व-प्रशिक्षित किया गया था। कंपनी ने दिखाया कि साधारण मानवीय वीडियो क्रिया-लेबल वाले डेटा का विकल्प बन सकता है, 1,000 से 1,000,000 घंटे तक स्केलिंग कानून स्थापित करके।

media MarkTechPost · 3 दिन पहले · 1 बार देखा गया

NVIDIA ने Nemotron 3.5 Lightning मॉडल और NeMo Switchyard राउटर जारी किए

NVIDIA ने हमेशा-सक्रिय AI एजेंट्स बनाने के लिए डिज़ाइन किए गए दो ओपन-सोर्स आर्टिफैक्ट जारी किए हैं: Nemotron 3.5 Lightning मॉडल और NeMo Switchyard राउटिंग लाइब्रेरी। ये टूल्स लंबे समय तक चलने वाले एजेंट वर्कफ़्लो के हर चरण को फ्रंटियर रीज़निंग मॉडल में भेजने की उच्च लागत और लेटेन्सी को विशेष निष्पादन और राउटिंग क्षमताएं प्रदान करके दूर करते हैं।

media MarkTechPost · 3 दिन पहले · 7 बार देखा गया

LTX ने स्थानीय वीडियो निर्माण के लिए खुले वजन वाले विश्व मॉडल LTX-2.5 को जारी किया

LTX ने वीडियो निर्माण, रियल-टाइम एप्लिकेशन और भौतिक AI के लिए एक खुले वजन वाले विश्व मॉडल LTX-2.5 को जारी किया है, जो NVIDIA RTX GPUs और DGX Spark हार्डवेयर पर स्थानीय इनफरेंस के लिए अनुकूलित है। यह रिलीज VRAM आवश्यकताओं को कम करके और प्रति-जनरेट शुल्क को समाप्त करके वीडियो उत्पादन को क्लाउड इंफ्रास्ट्रक्चर से स्थानीय डेस्कटॉप की ओर ले जाने का लक्ष्य रखती है।

media MarkTechPost · 4 दिन पहले · 5 बार देखा गया

webAI ने स्थानीय ऑटोफॉर्मलाइजेशन के लिए 1.7B और 3B फॉर्मल-लॉजिक मॉडल परिवार TwIL-LM जारी किया

webAI ने TwIL-LM जारी किया है, जो स्थानीय हार्डवेयर पर ऑटोफॉर्मलाइजेशन के लिए डिज़ाइन किए गए 1.7B और 3B पैरामीटर वाले फॉर्मल-लॉजिक रीजनर्स का दो-मॉडल परिवार है। ये मॉडल अंग्रेजी को प्रथम-क्रम तर्क (first-order logic) में अनुवाद करते हैं और निष्कर्ष की वैधता की जाँच करते हैं, जिसमें 3B वेरिएंट डोमेन-इन फॉर्मल लॉजिक कार्यों पर मैक्रो गेट स्कोर 0.4218 प्राप्त करता है।

media MarkTechPost · 4 दिन पहले SWE-bench Verified · 77.2% · 3 बार देखा गया

मेटा ने म्यूज़ ग्लिमर जारी किया, एक 30B ओपन-वेइट्स एजेंटिक मॉडल जो एक उपभोक्ता GPU पर चलता है

मेटा ने म्यूज़ ग्लिमर जारी किया है, जो म्यूज़ स्पार्क से संक्षिप्त किया गया और हमेशा-चालू स्थानीय एजेंट वर्कफ़्लो के लिए ट्यून किया गया एक 30-अरब पैरामीटर बहुआधारी मॉडल है। मॉडल Apache 2.0 लाइसेंस के तहत उपलब्ध है और नेटवर्क कॉल के बिना एकल उपभोक्ता GPU या Mac पर चलता है।

media MarkTechPost · 5 दिन पहले · 3 बार देखा गया

बाइटडेंस सीड ने सीडरियलटाइम पेश किया, एक नैटिव ऑडियो-विजुअल फुल-डप्लेक्स LLM

बाइटडेंस की सीड टीम ने सीडरियलटाइम का परिचय दिया है, जो एक नैटिव ऑडियो-विजुअल फुल-डप्लेक्स लार्ज लैंग्वेज मॉडल है जो ऑडियो, वीडियो और टेक्स्ट को एक एकीकृत आर्किटेक्चर में जोड़ता है। पारंपरिक ASR, VLM और TTS मॉड्यूल के कैस्केडेड स्टैक्स के विपरीत, सीडरियलटाइम निरंतर बहु-मोडल स्ट्रीम्स पर वास्तविक समय की अंतःक्रिया को सक्षम बनाने के लिए धारणा, समझ, निर्णय और अभिव्यक्ति को समानांतर में चलाता है।

media MarkTechPost · 5 दिन पहले · 13 बार देखा गया

NVIDIA ने NemotronLabs VoiceChat 11B जारी किया, जो ~450 ms टर्न-टेकिंग के साथ एक खुला फुल-डप्लेक्स स्पीच-टू-स्पीच मॉडल है

NVIDIA ने NemotronLabs VoiceChat 11B जारी किया है, जो रियल-टाइम, फुल-डप्लेक्स संवाद के लिए डिज़ाइन किया गया एक खुला 11B पैरामीटर एंड-टू-एंड स्पीच-टू-स्पीच मॉडल है। कैस्केडेड स्टैक के विपरीत जो ASR, LLM, और TTS को चेन करते हैं, यह यूनिफाइड नेटवर्क एक साथ स्ट्रीमिंग स्पीच समझ और जनरेशन करता है, जिसने Full-Duplex-Bench 1.0 पर मापा गया स्मूथ टर्न-टेकिंग लेटेंसी 448 ms प्राप्त किया।

media MarkTechPost · 6 दिन पहले Berkeley Function-Calling Leaderboard · 70.94% · 16 बार देखा गया

Pokee AI ने Pokee-Isaac 28B जारी किया, जो इन-बाउंड्री डिप्लॉयमेंट के लिए 10M-टोकन संदर्भ मॉडल है

Pokee AI ने Pokee-Isaac 28B जारी किया है, जो एक 28B पैरामीटर वाला केवल पाठ आधारित फाउंडेशन मॉडल है जिसमें 10M-टोकन संदर्भ विंडो है और इसे पूरी तरह से ग्राहक-नियंत्रित सीमाओं के भीतर संचालित करने के लिए डिज़ाइन किया गया है। मॉडल OpenAI-संगत API के माध्यम से उपलब्ध है और VPCs, ऑन-प्रेमिस वातावरणों, या डिवाइस-हार्डवेयर पर डिप्लॉयमेंट के लिए लाइसेंस प्राप्त है, न कि ओपन-वेट के रूप में।