लैब · Alibaba (Qwen)
media Latent Space · 2 दिन पहले GDPval-AA (Elo) · 1753.0Elo · 12 बार देखा गया

xAI ने Grok 4.6 जारी किया, Alibaba ने Qwen3.8-Max छोड़ा, DeepSeek V4 Pro GA

xAI ने Grok 4.6 जारी किया, जो लंबे समय तक चलने वाले एजेंट्स और इंटरैक्टिव वर्क पर केंद्रित एक 1.5T मॉडल है, जबकि Alibaba ने ओपन-वेट Qwen3.8-Max जारी किया और DeepSeek ने V4 Pro को अग्रेसिव प्राइसिंग के साथ सामान्य रूप से उपलब्ध कराया।

media AI News (smol.ai) · 2 दिन पहले GDPval-AA (Elo) · 1753.0Elo · 11 बार देखा गया

xAI ने Grok 4.6 जारी किया; Alibaba ने Qwen3.8-MoE को खोला; DeepSeek V4 Pro GA

इस सप्ताह की AI समाचारों में xAI, Alibaba और DeepSeek से प्रमुख रिलीज़ के साथ-साथ ओपन वीडियो मॉडल और इनफ्रेंस इंफ्रास्ट्रक्चर में अपडेट भी शामिल हैं।

media AI News (smol.ai) · 10 दिन पहले Terminal-Bench 2 · 67.4% · 21 बार देखा गया

अलibaba ने 2.4T पैरामीटर और आगामी ओपन वेट्स के साथ Qwen3.8-Max की घोषणा की

अलibaba ने अपने नए फ्लैगशिप मॉडल के रूप में Qwen3.8-Max की घोषणा की है, जिसे लंबे समय तक चलने वाले एजेंटिक कार्य, कोडिंग और बहुआयामी तर्क पर केंद्रित 2.4T-पैरामीटर स्पार्स आर्किटेक्चर के रूप में वर्णित किया गया है। कंपनी ने पुष्टि की कि Qwen3.8-Max के लिए ओपन वेट्स अगले सप्ताह ओपन-वेट Qwen3.8-27B वेरिएंट के साथ जारी किए जाएंगे।

media Latent Space · 11 दिन पहले · 10 बार देखा गया

अलिबाबा ने अगले सप्ताह ओपन वेट के साथ 2.4T-पैरामीटर मॉडल Qwen 3.8 Max की घोषणा की

अलिबाबा का Qwen टीम ने कोडिंग, लॉंग-होराइजन एजेंटिक वर्क और मल्टीमोडल रीज़निंग पर केंद्रित एक नए 2.4T-पैरामीटर फ्लैगशिप मॉडल Qwen 3.8 Max की घोषणा की है। कंपनी ने पुष्टि की कि Qwen 3.8 Max और छोटे Qwen 3.8-27B दोनों के ओपन-वेट वर्जन अगले सप्ताह रिलीज़ किए जाएंगे।

media MarkTechPost · 11 दिन पहले GPQA Diamond · 92.6% · 22 बार देखा गया

अलibaba ने 2.4T-पैरामीटर MoE मॉडल Qwen3.8-Max जारी किया

अलibaba की Qwen टीम ने Qwen3.8-Max को API के माध्यम से व्यापक रूप से उपलब्ध कराया है, और Qwen3.8-Max तथा छोटे Qwen3.8-27B चेकपॉइंट दोनों के लिए ओपन वेट्स अगले सप्ताह शिप होने की योजना है। फ्लैगशिप मॉडल एक 2.4-ट्रिलियन-पैरामीटर मिक्स्चर-ऑफ-एक्सपर्ट्स आर्किटेक्चर है जो टेक्स्ट, इमेज और वीडियो इनपुट स्वीकार करता है।

media TLDR AI · 23 दिन पहले · 1 बार देखा गया

Google ने Gemini 3.6 Flash जारी किया; OpenAI ने मॉडल सुरक्षा पलायन की रिपोर्ट की

Google ने तीन नए मॉडल जारी किए हैं: कुशल सामान्य-उद्देश्य एजेंट कार्यभार के लिए Gemini 3.6 Flash, कम विलंबता वाले अनुप्रयोगों के लिए 3.5 Flash-Lite, और CodeMender के साथ एकीकृत साइबर-विशेषज्ञ 3.5 Flash मॉडल।

media MarkTechPost · 26 दिन पहले · 7 बार देखा गया

अलीबाबा ने 2.4T-पैरामीटर वाला बहुआयामी मॉडल Qwen3.8-Max का प्रीव्यू दिया

19 जुलाई को, अलीबाबा की Qwen टीम ने 2.4 ट्रिलियन पैरामीटरों वाले एक नए फ्लैगशिप बहुआयामी मॉडल Qwen3.8-Max-Preview का प्रीव्यू दिया। यह घोषणा शंघाई में विश्व AI सम्मेलन के दौरान की गई, जो Moonshot AI द्वारा अपने Kimi K3 मॉडल को जारी करने के दो दिन बाद आई।

media r/LocalLLaMA · 11 घंटे पहले · 2 बार देखा गया

Qwen 3.8 Max रिलीज़ में योजना, सरलीकरण और प्रायोगिक डिज़ाइन पर जोर

Qwen 3.8 Max का पूर्ण रिलीज़ इस प्रारंभिक धारणा की पुष्टि करता है कि मॉडल असाधारण रूप से तेज़ है, योजना बनाने में अत्यधिक सक्षम है, और समस्याओं में अनावश्यक जटिलता को पहचानने में कुशल है।

lab NVIDIA Technical Blog · 2 दिन पहले · 5 बार देखा गया

अलibaba ने NVIDIA GB300 NVL72 के लिए Qwen3.8-2.4T-A95B ओपन वेट्स जारी किए

अलibaba ने अपने सबसे बड़े ओपन-वेट मॉडल Qwen3.8-2.4T-A95B (जिसे Qwen3.8-Max के रूप में भी जाना जाता है) के लिए ओपन वेट्स जारी किए हैं, जिसे ओपन एकोसिस्टम में न्यूनतम सीमा की क्षमताएं लाने के लिए डिज़ाइन किया गया है।

arxiv arXiv cs.LG · 4 दिन पहले · 2 बार देखा गया

Macaron-V1 ने Mixture-of-LoRA के साथ निरंतर सीखने के लिए खुला एजेंट-मॉडल परिवार पेश किया

Macaron-V1 एक खुला एजेंट-मॉडल परिवार है जो अनुभवजन्य बुद्धिमत्ता के लिए डिज़ाइन किया गया है, जो वास्तविक पर्यावरण से सीखने और तैनाती के बाद भी सीखते रहने में सक्षम बनाता है। सिस्टम दो लक्ष्यों पर केंद्रित है: मॉडल-हार्नेस जोड़ों के पुनरावर्ती सुधार के माध्यम से अनुकूलन और प्रति उपयोगकर्ता पाले विशेषज्ञ LoRA एडेप्टर्स का चयन करने वाली Mixture-of-LoRA (MoL) आर्किटेक्चर के माध्यम से सहयोग।

arxiv arXiv cs.CL · 4 दिन पहले · 10 बार देखा गया

Macaron-V1 ने Mixture-of-LoRA के साथ निरंतर सीखने के लिए खुला एजेंट-मॉडल परिवार पेश किया

Macaron-V1 एक खुला एजेंट-मॉडल परिवार है जो अनुभवजन्य बुद्धिमत्ता के लिए डिज़ाइन किया गया है, जिससे सिस्टम वास्तविक दुनिया के अनुभवों से सीख सकते हैं और तैनाती के बाद भी सुधार जारी रख सकते हैं। आर्किटेक्चर दो लक्ष्यों पर केंद्रित है: मॉडल-हार्नेस जोड़ों की पुनरावृत्त स्वयं-सुधार के माध्यम से अनुकूलन, और उपयोगकर्ता चरण के प्रति विशेषज्ञ एडेप्टर्स का चयन करने वाले Mixture-of-LoRA (MoL) सिस्टम के सहयोग के माध्यम से।

media r/LocalLLaMA · 8 दिन पहले

कृत्रिम विश्लेषण द्वारा ओपस 5 से आगे, क्वेन 3.8 मैक्स को सर्वश्रेष्ठ समग्र मॉडल के रूप में रैंक किया गया

कृत्रिम विश्लेषण ने अपने एजेंटिक इंडेक्स को अपडेट किया है और क्वेन 3.8 मैक्स को सर्वश्रेष्ठ समग्र मॉडल के रूप में रैंक किया है, इसे ओपस 5 से आगे रखते हुए।

media Don't Worry About the Vase · 8 दिन पहले · 3 बार देखा गया

OpenAI ने Luna की कीमतें कम कीं, Alibaba ने Qwen 3.8-Max जारी किया, और DeepMind में नेतृत्व परिवर्तन

यह न्यूज़लेटर AI उद्योग में हाल के विकासों को कवर करता है, जिसमें OpenAI द्वारा महत्वपूर्ण कीमत बदलाव, Alibaba से नए मॉडल रिलीज, और Google DeepMind में प्रमुख नेतृत्व परिवर्तन शामिल हैं।

media AI News (smol.ai) · 10 दिन पहले · 2 बार देखा गया

Qwen, NVIDIA, Mistral और Black Forest Labs ने नए मॉडल जारी किए; राउटिंग और सुरक्षा पर ध्यान केंद्रित

यह 3-4 अगस्त 2026 के लिए AI समाचार समीक्षा Alibaba Qwen, NVIDIA, Mistral AI और Black Forest Labs से महत्वपूर्ण मॉडल रिलीज़, एजेंट राउटिंग, इंफ्रास्ट्रक्चर और साइबर सुरक्षा में विकास को कवर करती है।