विषय · Open weights
lab Google DeepMind Blog · 3 घंटे पहले

Google DeepMind ने SynthID Bio का परिचय दिया ताकि AI-जनित प्रोटीन में वॉटरमार्क किया जा सके

Google DeepMind ने SynthID Bio पेश किया है, जो एक प्रूफ-ऑफ-कॉन्सेप्ट तकनीक है जो AI द्वारा डिजाइन किए गए प्रोटीन और संरचनाओं के जैविक कोड में अदृश्य वॉटरमार्क सीधे एम्बेड करती है। यह दृष्टिकोण सुनिश्चित करता है कि हस्ताक्षर संश्लेषित भौतिक प्रोटीन पर ही सत्यापित किया जा सके, जबकि उसकी जैविक कार्यक्षमता को बनाए रखा जाए।

lab Microsoft Research Blog · 9 दिन पहले · 62 बार देखा गया

माइक्रोसॉफ्ट ने रेट्रोसाइमेरा को रेट्रोसिंथेसिस भविष्यवाणी के लिए जारी किया

माइक्रोसॉफ्ट रिसर्च ने रेट्रोसिंथेसिस भविष्यवाणी के लिए एक नया फ्रेमवर्क, RetroChimera को प्रकाशित और ओपन-सोर्स किया है, जो उच्च गुणवत्ता वाले संश्लेषण मार्गों का सुझाव देने के लिए दो पूरक मॉडलों को जोड़ता है। सिस्टम एक सीखी हुई एन्सेंबलिंग रणनीति का उपयोग करके R-SMILES 2, एक Transformer-आधारित de-novo मॉडल, और NeuralLoc, एक ग्राफ न्यूरल नेटवर्क (GNN) आधारित मॉडल को एकीकृत करता है।

lab Google DeepMind Blog · 22 दिन पहले · 39 बार देखा गया

गूगल डीपमाइंड ने हर मानव DNA वेरिएंट के लिए अल्फाजीनोम एटलस जारी किया

गूगल डीपमाइंड ने अल्फाजीनोम एटलस जारी किया है, जो मानव जीनोम भर में 9 बिलियन सिंगल-न्यूक्लियोटाइड वेरिएंट्स के प्रभावों की भविष्यवाणियों वाला एक प्लेटफ़ॉर्म है। यह संसाधन आनुवंशिक उत्परिवर्तनों के आणविक जीव विज्ञान को कैसे प्रभावित करते हैं, का एक व्यापक मानचित्र प्रदान करके जैविक समझ को तेज़ करने का लक्ष्य रखता है।

lab Google — The Keyword (AI) · 15 दिन पहले · 27 बार देखा गया

गूगल ने जेमिनी 3.5, ओपन डेटासेट और ऑफ़लाइन अनुवाद के साथ बहुभाषी एआई का विस्तार किया

गूगल ने बताया कि अब उसकी तकनीकें 7 अरब से अधिक लोगों के लिए 300 से अधिक भाषाओं का समर्थन करती हैं, और उच्चारण समझ, कम प्रतिनिधित्व वाली भाषाओं के लिए डेटा संग्रह और सुलभता में सुधार करने के लिए नए उपकरण पेश किए गए हैं।

lab Hugging Face Blog · 1 दिन पहले · 8 बार देखा गया

शून्य-शॉट तालिका पूर्वानुमान के लिए NVIDIA ने खुला Kumo Tabular फाउंडेशन मॉडल जारी किया

NVIDIA ने Kumo Tabular जारी किया है, जो तालिका वर्गीकरण और रिग्रेशन के लिए एक खुला फाउंडेशन मॉडल है जो प्रशिक्षण या फीचर इंजीनियरिंग की आवश्यकता के बिना इन-कॉन्टेक्स्ट लर्निंग के माध्यम से संचालित होता है। स्ट्रक्चरल काज़ुअल मॉडल्स द्वारा उत्पन्न कृत्रिम डेटा पर ही प्रीट्रेन किया गया, इस मॉडल को 28M से 215M पैरामीटर तक के तीन आकारों में उपलब्ध कराया गया है।

lab Hugging Face Blog · 2 दिन पहले OSWorld 2.0 · 61.7% · 9 बार देखा गया

Holo4: GUIs, कोड और API के लिए सामान्यीकृत एजेंटिक मॉडल

Holo4 H Company द्वारा एजेंटिक मॉडल्स की एक नई श्रृंखला है, जो 27B डेंस और 35B-A3B मिक्सचर ऑफ एक्सपर्ट्स आकारों में उपलब्ध है। ये मॉडल किसी भी इंटरफ़ेस—GUIs, कोड, MCP या API—के माध्यम से सॉफ़्टवेयर के साथ इंटरैक्ट करते हैं और एक ही मॉडल का उपयोग करके डेस्कटॉप, वेब, Android और सैंडबॉक्स पर चलते हैं।

media AI News (smol.ai) · 18 दिन पहले · 51 बार देखा गया

DeepSeek ने V4.1-Flash लॉन्च किया, जो अत्यंत निष्पादन दक्षता पर केंद्रित एक ओपन-वेट मॉडल है

DeepSeek ने V4.1-Flash जारी किया है, जो अत्यंत निष्पादन दक्षता और कम लागत के लिए डिज़ाइन किया गया एक नया ओपन-वेट फ्लैगशिप मॉडल है। यह मॉडल सक्रिय कंप्यूटेशन और KV/cache लागत को काफी कम करने के लिए एक कारणिक एन्कोडर-डीकोडर आर्किटेक्चर का उपयोग करता है।

media Latent Space · 19 दिन पहले · 34 बार देखा गया

DeepSeek ने कुशल इनफरेंस के लिए 763B-P8B-D16B आर्किटेक्चर के साथ v4.1-Flash जारी किया

DeepSeek ने DeepSeek v4.1-Flash लॉन्च किया है, जो एक नया ओपन-वेट फ्लैगशिप मॉडल है जिसमें इनफरेंस दक्षता को अधिकतम करने और लागत कम करने के लिए डिज़ाइन की गई एक नई कारणवादी एन्कोडर-डीकोडर आर्किटेक्चर शामिल है।

media MarkTechPost · 20 दिन पहले · 55 बार देखा गया

DeepSeek ने 1M संदर्भ और FP4 KV कैश के साथ DeepSeek-V4.1-Flash जारी किया

DeepSeek AI ने DeepSeek-V4.1-Flash जारी किया है, जो एक बहुमोडल मिक्स्चर-ऑफ-एक्सपर्ट्स मॉडल है जिसमें 1-मिलियन-टोकन संदर्भ विंडो और FP4 KV कैश शामिल है जो प्रति टोकन 890 बाइट के वैश्विक कैश फुटप्रिंट को कम करता है। मॉडल एक कारणवादी एन्कोडर-डीकोडर आर्किटेक्चर और कॉम्प्रेस्ड स्पार्स एटेंशन 2 (CSA2) का उपयोग करता है जो प्रदर्शन बनाए रखते हुए मेमोरी की आवश्यकताओं को काफी कम करता है।

media MarkTechPost · 1 दिन पहले Android World · 85.1% · 8 बार देखा गया

H कंपनी ने डेस्कटॉप, वेब और मोबाइल के लिए Holo4 ओपन-वेट कंप्यूटर-यूज़ मॉडल जारी किए

H कंपनी ने Holo4 जारी किया है, जो एक सामान्यीकृत कंप्यूटर-यूज़ विजन-लैंग्वेज मॉडल परिवार है जिसे डेस्कटॉप, वेब, Android और API वातावरण में क्लिक करने, टाइप करने, कोड लिखने और टूल्स को कॉल करने के लिए डिज़ाइन किया गया है। रिलीज में दो मॉडल आकार शामिल हैं: Holo4 27B (dense) और Holo4 35B-A3B (Mixture of Experts with 3B active parameters), दोनों 256K context window का समर्थन करते हैं।

media MarkTechPost · 1 दिन पहले SWE-bench Verified · 79.0% · 7 बार देखा गया

AI एजेंट हार्नेस ओवरफिटिंग को रोकने के लिए Google Research ने RRSI जारी किया

Google Cloud AI Research, UNC-Chapel Hill, Stanford और Washington University in St. Louis के सहयोग से, RRSI (Regularized Recursive Self-Improvement) को ओपन-सोर्स कर चुका है। यह फ्रेमवर्क एक LLM एजेंट को मॉडल वेट्स को बदले बिना अपने हार्नेस—जिसमें प्रॉम्प्ट्स, टूल्स, मेमोरी, कंट्रोल फ्लो और सब-एजेंट शामिल हैं—को पुनः लिखने की अनुमति देता है।

media r/LocalLLaMA · 1 दिन पहले · 3 बार देखा गया

IQuestLab ने एजेंटिक कोडिंग के लिए 320B MoE मॉडल IQuest-Q1 जारी किया

IQuest ने एजेंटिक कोडिंग, तर्क और बहु-चरण उपकरण उपयोग के लिए डिज़ाइन किए गए Mixture-of-Experts (MoE) मॉडल IQuest-Q1 को जारी किया है। मॉडल में लगभग 320 अरब कुल पैरामीटर हैं, जिसमें प्रति टोकन अनुमानित 15 अरब पैरामीटर सक्रिय होते हैं। यह Hugging Face पर उपलब्ध है।

media r/LocalLLaMA · 1 दिन पहले GPQA Diamond · 91.41% · 18 बार देखा गया

ISTA ने Qwen3.8-Flash-Next और 50% विशेषज्ञ-कटाई वाले कोडर बिल्ड के लिए GSQ-RCO GGUF जारी किए

ISTA डीप एल्गोरिदम और सिस्टम्स लैब ने विरल मिक्स्चर-ऑफ़-एक्सपर्ट्स मॉडल Qwen3.8-Flash-Next के क्वांटाइज्ड GGUF संस्करण जारी किए हैं, साथ ही एक प्रयोगात्मक क्षमता-लक्षित बिल्ड भी जारी की गई है जिसमें इसके आधे विशेषज्ञों को हटा दिया गया है।

media r/LocalLLaMA · 2 दिन पहले · 5 बार देखा गया

NVIDIA Nemotron-Labs-3 Competitive-Coding मॉडल ने IOI 2026 पर 535.4 अंक हासिल किए

NVIDIA ने Nemotron-Labs-3-Competitive-Coding मॉडल जारी किया है, जो NVIDIA-Nemotron-3-Ultra-550B-A55B से फाइन-ट्यूंड एक कॉम्पिटिटिव प्रोग्रामिंग विशेषज्ञ है। इस मॉडल का प्रशिक्षण GLM-5.2 से डिस्टिल्ड सिंथेटिक रीजनिंग ट्रेस पर किया गया था और इसे IOI 2026 समस्या सेट पर लाइव एवल्यूएट किया गया।

media Hugging Face Forums · 2 दिन पहले · 4 बार देखा गया

NewTypeCola ने 66,010 पृष्ठों वाले कोरियाई VOKU Archive डेटासेट को रिलीज़ किया

NewTypeCola ने Hugging Face पर VOKU Archive प्रकाशित किया है, जो दक्षिण कोरिया में छात्र-संचालित कैंपस रेडियो ब्रॉडकास्ट cue sheets की 66,010 स्कैन की गई पृष्ठों का संग्रह है। दस्तावेज़ 1988 से 2019 तक फैले हुए हैं और OCR टेक्स्ट, उपनाम-टोकन एनोटेशन और मेटाडेटा शामिल हैं।

media Hugging Face Forums · 2 दिन पहले · 3 बार देखा गया

ZYK Labs ने AI Beacon जारी किया, जो स्वैच्छिक AI-एजेंट संवादों के लिए एक खुला इनबॉक्स है

ZYK Labs ने AI Beacon जारी किया है, जो AI एजेंट्स के साथ संचार को सुविधाजनक बनाने के लिए डिज़ाइन किया गया एक छोटा ओपन-सोर्स प्रयोग है। सिस्टम अधिकृत एजेंट्स को उनके कार्यों के दौरान सार्वजनिक आमंत्रण मिलने पर संवाद शुरू करने की अनुमति देता है।

media MarkTechPost · 5 दिन पहले · 27 बार देखा गया

ब्लैक फॉरेस्ट लैब्स ने FLUX 3 Action जारी किया, एक 7B ओपन-वेइट्स वर्ल्ड एक्शन मॉडल

ब्लैक फॉरेस्ट लैब्स ने रोबोट नियंत्रण के लिए एक 7B पैरामीटर ओपन-वेइट्स वर्ल्ड एक्शन मॉडल (WAM) FLUX 3 Action जारी किया है, जो RoboLab-120 लीडरबोर्ड पर 42.92% टास्क सक्सेस रेट के साथ पहले स्थान पर है।

media Hugging Face Forums · 6 दिन पहले GPQA Diamond · 93.94% · 22 बार देखा गया

VeriLoop E2: BF16 से IQ1_M तक GGUF सीढ़ी के साथ 27B पोस्ट-ट्रेन्ड मॉडल

Tsinghua SIGS Robot Lab ने VeriLoop E2 जारी किया है, जो सत्यापनीय कोड, गणित और वैज्ञानिक तर्क के लिए Qwen3.8-27B पर बनाया गया एक 27B पोस्ट-ट्रेन्ड मॉडल है। इस रिलीज में VeriLoop-Governed Recurrence (VGR) पेश किया गया है, जो अवस्था संक्रमण को सत्यापन आयामों को कड़ाई से सुधारने की गारंटी देने के लिए उत्पादन को बाहरी सत्यापन से अलग करता है।

media MarkTechPost · 7 दिन पहले · 16 बार देखा गया

NVIDIA ने 8 वक्ताओं को ट्रैक करने वाले 100M-पैरामीटर मॉडल Nemotron 3 Diarization जारी किया

NVIDIA ने Hugging Face पर OpenMDW License 1.1 के तहत उपलब्ध एक ओपन-वेट स्पीकर डायरिजेशन मॉडल Nemotron 3 Diarization जारी किया है। यह 100M-पैरामीटर वाला मॉडल एकल चेकपॉइंट का उपयोग करके रियल-टाइम या ऑफलाइन मोड में 8 ओवरलैपिंग वक्ताओं को ट्रैक करता है।

media r/LocalLLaMA · 7 दिन पहले · 43 बार देखा गया

Apple ने LensVLM-9B जारी किया, एक VLM जो संपीड़ित पाठ छवियों का चयनात्मक रूप से विस्तार करता है

Apple ने LensVLM-9B जारी किया है, जो 9 अरब पैरामीटर वाला एक Vision Language Model है जिसे पाठ की संपीड़ित छवियों को अधिक कुशलता से प्रसंस्कृत करने के लिए डिज़ाइन किया गया है। मॉडल इन संपीड़ित इनपुट्स को स्कैन करता है और सीखे गए टूल्स का उपयोग करके केवल प्रासंगिक पृष्ठों को उनके अविस्तारित रूप में चयनात्मक रूप से विस्तारित करता है।