Open weights
media TLDR AI · 2 घंटे पहले · 10 बार देखा गया

Xiaomi ने MiMo-V2.6 Pro और Flash मॉडल ओपन-सोर्स किए

Xiaomi ने MiMo-V2.6 Pro और Flash ओमिमोडल मॉडल ओपन-सोर्स किए हैं, जो इंटरैक्टिव 3D सीन्स को बनाने और दृश्य रूप से परीक्षण करने के लिए एजेंट्स को समन्वयित करने के लिए डिज़ाइन किए गए हैं। ये मॉडल Blender संपत्तियाँ उत्पन्न कर सकते हैं, कैमरा फ़ीड से रोबोटिक आर्म को नियंत्रित कर सकते हैं, फ्रंटएंड और प्रस्तुतियाँ बना सकते हैं, वीडियो एसेंबल कर सकते हैं और संगीत को स्कोर और MIDI के रूप में संयोजित कर सकते हैं।

media Latent Space · 22 घंटे पहले · 11 बार देखा गया

शियाओमी ने 3 मिलियन डॉलर में प्रशिक्षित शीर्ष ओपन-वेट्स ओमिमोडल मॉडल MiMo-V2.6-Pro जारी किया

शियाओमी ने MiMo-V2.6 सीरीज जारी की है, जिसमें MiMo-V2.6-Pro और MiMo-V2.6-Flash सहित नैटिवली ओमिमोडल मॉडल्स शामिल हैं। कंपनी ने MiMo-V2.6-Pro-UltraSpeed भी लॉन्च किया है, जो समान गुणवत्ता पर आउटपुट गति को 20x तक तेज करता है।

media MarkTechPost · 1 दिन पहले Terminal-Bench 2 · 69.7% · 9 बार देखा गया

AWS Strands Agents ने कम टोकन लागत के साथ ओपन-सोर्स Strands Harness जारी किया

AWS Strands Agents टीम ने Strands Harness जारी किया है, जो एक ओपन-सोर्स, सामान्य उद्देश्य वाला एजेंट हार्नेस है जो Python और TypeScript के लिए Apache 2.0 लाइसेंस के तहत उपलब्ध है। इस टूल का डिज़ाइन Claude Code या Codex जैसे वातावरण में एजेंट्स को प्रोटोटाइप करने और उन्हें कस्टम लूप के साथ तैनात करने के बीच की खाई को पाटने के लिए किया गया है।

lab Microsoft Research Blog · 2 दिन पहले · 29 बार देखा गया

माइक्रोसॉफ्ट ने रेट्रोसाइमेरा को रेट्रोसिंथेसिस भविष्यवाणी के लिए जारी किया

माइक्रोसॉफ्ट रिसर्च ने रेट्रोसिंथेसिस भविष्यवाणी के लिए एक नया फ्रेमवर्क, RetroChimera को प्रकाशित और ओपन-सोर्स किया है, जो उच्च गुणवत्ता वाले संश्लेषण मार्गों का सुझाव देने के लिए दो पूरक मॉडलों को जोड़ता है। सिस्टम एक सीखी हुई एन्सेंबलिंग रणनीति का उपयोग करके R-SMILES 2, एक Transformer-आधारित de-novo मॉडल, और NeuralLoc, एक ग्राफ न्यूरल नेटवर्क (GNN) आधारित मॉडल को एकीकृत करता है।

media MarkTechPost · 2 दिन पहले · 14 बार देखा गया

अलibaba क्वेन ने छवि उत्पादन और संपादन के लिए एकत्रीकृत 7B Qwen-Image-2.1 मॉडल जारी किया

अलibaba की क्वेन टीम ने Qwen-Image-2.1 जारी किया है, जो एकत्रीकृत टेक्स्ट-टू-इमेज जनरेशन और इमेज संपादन मॉडल है जो पिछले अलग-अलग चेकपॉइंट्स को एकल 7B पैरामीटर डिफ्यूजन ट्रांसफॉर्मर में समेटता है।

lab Hugging Face Blog · 2 दिन पहले · 10 बार देखा गया

tokenizers v1 रिलीज़ कैंडिडेट बिटस्ट्रीम विभाजन और कैशिंग के माध्यम से 3-30x तेज एन्कोडिंग प्रदान करता है

tokenizers लाइब्रेरी ने टेक्स्ट एन्कोडिंग के लिए प्रदर्शन में महत्वपूर्ण सुधार करने वाला एक संस्करण 1 रिलीज़ कैंडिडेट जारी किया है, जो प्रशिक्षण और सर्विंग वर्कफ़्लो में बॉटलनेक को दूर करता है। यह अपडेट v0.23 के साथ API संगतता बनाए रखते हुए दस मॉडल परिवारों में महत्वपूर्ण गति वृद्धि प्रदान करता है।

lab Hugging Face Blog · 2 दिन पहले MMLU · 77.0% · 15 बार देखा गया

मल्टीवर्स LLM ब्लॉक हटाने को आइसिंग अनुकूलन के रूप में पुनर्परिभाषित करता है ताकि गहन संपीड़न संभव हो

मल्टीवर्स ने एक पेपर जारी किया है जिसमें एक विधि का विवरण दिया गया है जो बड़े भाषा मॉडल प्रूनिंग को एक बाध्य द्विआधारी अनुकूलन समस्या के रूप में पुनर्परिभाषित करती है और इसे आइसिंग ग्लास पर मैप करती है। ट्रान्सफॉर्मर ब्लॉकों को स्पिन के रूप में मानते हुए, जिसमें हानि हेसियन से व्युत्पन्न युग्मन होते हैं, यह दृष्टिकोण पुनरावृत्ति बेंचमार्किंग की आवश्यकता के बिना इष्टतम ब्लॉक हटाने की विन्यासों की पहचान करता है।

media Interconnects · 2 दिन पहले Artificial Analysis Intelligence Index · 45.0% · 17 बार देखा गया

चीनी ओपन-वेट मॉडल डाउनलोड और बेंचमार्क में अमेरिकी प्रतिद्वंद्वियों को पछाड़ते हैं

लेखक ने ओपन-वेट मॉडलों की स्थिति पर एक संक्षिप्त विवरण प्रस्तुत किया है, यह नोट करते हुए कि चीनी एआई कंपनियां अप्रैल 2025 के आसपास से इस क्षेत्र में स्पष्ट रूप से अग्रणी बन गई हैं। यह बदलाव Hugging Face डाउनलोड मेट्रिक्स और क्षमता बेंचमार्क पर प्रदर्शन द्वारा प्रमाणित होता है।

media r/LocalLLaMA · 3 दिन पहले · 9 बार देखा गया

Stepfun ने Step 5 Preview 600B-A27B जारी किया, वजन 15 अक्टूबर को

Stepfun ने Step 5 Preview 600B-A27B मॉडल जारी किया है, जो वर्तमान में इसके उत्पादों और API के माध्यम से उपलब्ध है। इस मॉडल का ओपन-वेट संस्करण 15 अक्टूबर को जारी किया जाएगा।

media r/LocalLLaMA · 4 दिन पहले · 11 बार देखा गया

अलibaba ने कैंसर और लगभग 150 स्थितियों का पता लगाने में सक्षम चिकित्सा AI मॉडल को ओपन-सोर्स किया

अलibaba ने एक ओपन-सोर्स चिकित्सा कृत्रिम बुद्धिमत्ता मॉडल जारी किया है जो कैंसर और लगभग 150 अन्य चिकित्सा स्थितियों का पता लगा सकता है।

media r/LocalLLaMA · 5 दिन पहले · 36 बार देखा गया

inclusionAI ने Realtime-Venus जारी किया, एक 9B ऑडियो-विजुअल इंटरैक्शन मॉडल

inclusionAI ने Hugging Face पर Realtime-Venus सिस्टम जारी किया है, जिसमें दो चेकपॉइंट्स शामिल हैं: Realtime-Venus-Omni और Realtime-Venus-Audio। Omni चेकपॉइंट एक 9B ऑडियो-विजुअल इंटरैक्शन मॉडल है जो MiniCPM-o 4.5 से अनुकूलित किया गया है और लगातार देखता और सुनता रहता है ताकि यह तय कर सके कि कब प्रतिक्रिया देनी है।

media r/LocalLLaMA · 5 दिन पहले · 17 बार देखा गया

$1.4B मूल्यांकन वाली Naive AI, ओपन-वेट LLM रिलीज़ की योजना

त्सिंगहुआ यूनिवर्सिटी के प्रोफेसर डैई जिफेंग द्वारा स्थापित Stealth स्टार्टअप Naive AI ने $400 मिलियन के कुल निधि चक्र पूरे किए हैं, जिससे इसका मूल्यांकन $1.4 बिलियन से अधिक हो गया है। कंपनी इसी महीने से भी पहले अपने पहले बड़े भाषा मॉडल (जिसका नाम भी Naive है) को ओपन-वेट रिलीज़ के रूप में लाने की तैयारी कर रही है।

lab Tencent Hunyuan (HF) · 6 दिन पहले · 23 बार देखा गया

टेंसेंट ने WeVisDoc-2B और WeVisDoc-4B दस्तावेज़ पार्सर जारी किए

टेंसेंट ने Qwen3-VL मॉडलों से फाइन-ट्यून किए गए पेज इमेज के लिए एक एंड-टू-एंड दस्तावेज़ पार्सर, WeVisDoc जारी किया है। सिस्टम पेज इमेज को संरचित Markdown में परिवर्तित करता है, जिसमें LaTeX सूत्र और HTML टेबल शामिल हैं।

lab Tencent Hunyuan (HF) · 6 दिन पहले · 64 बार देखा गया

Tencent ने WeVisDoc-4B जारी किया, एक एंड-टू-एंड दस्तावेज़ पार्सर

Tencent ने पेज इमेज के लिए एक एंड-टू-एंड दस्तावेज़ पार्सर WeVisDoc-4B जारी किया है जो पेजों को LaTeX सूत्रों और HTML तालिकाओं के साथ संरचित Markdown में परिवर्तित करता है। Qwen3-VL-4B-Instruct से फाइन-ट्यून किए गए, मॉडल ने OmniDocBench v1.6 पर 95.38 का समग्र स्कोर प्राप्त किया और सभी चार रिपोर्ट किए गए सेटिंग्स में तुलना किए गए पार्सर्स के बीच पहले स्थान पर है।

media Together AI Blog · 7 दिन पहले · 16 बार देखा गया

बंद स्रोत से खुले स्रोत मॉडल में माइग्रेशन के लिए टूगेदर ने रणनीति की रूपरेखा तैयार की

टूगेदर प्रबंधित सेवाओं का उपयोग करके उद्यमों को बंद-स्रोत AI मॉडल से खुले स्रोत मॉडल (OSM) में माइग्रेशन के लिए एक ढांचा प्रदान करता है, जिसका उद्देश्य जटिलता को कम करना और अपनाने की गति बढ़ाना है। इस प्रक्रिया में बेंचमार्क के माध्यम से उपयुक्त मॉडल खोजना, ट्रैफिक रीप्ले के माध्यम से उनका मूल्यांकन करना, प्रॉम्प्ट या वजन को अनुकूलित करना और स्विच को औचित्य देने के लिए ROI की गणना करना शामिल है।

media r/LocalLLaMA · 7 दिन पहले · 18 बार देखा गया

मोज़िला की रिपोर्ट के अनुसार चीन के ओपन-वेट AI मॉडल अमेरिका के फ्रंटियर ऑफरिंग्स से 4 महीने पीछे हैं

मोज़िला की एक रिपोर्ट संकेत देती है कि चीन के ओपन-वेट AI मॉडलों ने विकास में अंतर को केवल चार महीने तक कम कर दिया है। इस तेज़ प्रगति के बावजूद, मॉडल कुछ बेंचमार्क मूल्यांकनों में पीछे रहते हैं।