सभी लेख
lab xAI News · अभी अभी लाइव

xAI ने GitHub Copilot में Grok 4.6 कोडिंग मॉडल जारी किया

xAI ने VS Code और अन्य प्लेटफार्मों का उपयोग करने वाले डेवलपर्स के लिए GitHub Copilot के भीतर अपने नवीनतम कोडिंग मॉडल, Grok 4.6, उपलब्ध कराया है। उपयोगकर्ता मॉडल पिकर के माध्यम से नए मॉडल का चयन कर सकते हैं, जबकि एंटरप्राइज़ ग्राहकों को Copilot सेटिंग्स के माध्यम से इसे सक्षम करने की आवश्यकता हो सकती है।

media Interconnects · अभी अभी लाइव

Z.ai ने GLM-5.3 को विस्तारित पोस्ट-ट्रेनिंग के साथ जारी किया

Z.ai ने GLM-5.3 की घोषणा की, एक नया मॉडल जो अपने GLM-5.2 बेस मॉडल के पोस्ट-ट्रेनिंग को बढ़ाकर एजेंटिक कोडिंग बेंचमार्क्स पर फ्रंटियर प्रदर्शन हासिल करता है। ~750B पैरामीटर वाला मॉडल वर्तमान में Kimi K3 से आगे है और विभिन्न बेंचमार्क्स पर Claude Fable 5 और GPT-5.6-Sol के बराबर या उससे अधिक है।

github llama.cpp · 2 घंटे पहले

llama.cpp b10434 टेम्पलेट्स को reasoning_effort पास करता है

llama.cpp प्रोजेक्ट ने बिल्ड b10434 जारी किया, जिसने Jinja टेम्पलेट्स में `reasoning_effort` पैरामीटर पास करने का समर्थन जोड़ा। इस बदलाव से OpenAI Chat Completions के `reasoning_effort` मानों को संग्रहीत और जनरेशन के दौरान उपलब्ध कराया जाता है।

lab Anthropic News · 2 घंटे पहले · 2 बार देखा गया

क्लाउड एनएआई अधिनियम के अनुपालन के लिए SynthID-Text वॉटरमार्किंग लागू करता है

एंथ्रोपिक भविष्य के क्लाउड मॉडल्स में पाठ वॉटरमार्किंग लागू करेगा ताकि वह यूरोपीय संघ एनएआई अधिनियम और एनएआई-जनित सामग्री की पारदर्शिता पर उसके व्यवहार संहिता का अनुपालन कर सके। कंपनी गूगल डीपमाइड द्वारा प्रकाशित SynthID-Text विधि का उपयोग करती है, जो उत्पादित गुणवत्ता को प्रभावित किए बिना और अतिरिक्त टोकन जोड़े बिना, उत्पन्न पाठ में एक पहचानने योग्य पैटर्न एम्बेड करती है।

lab NVIDIA Research · 3 घंटे पहले · 1 बार देखा गया

HorizonRelight लंबी अवधि के वीडियो रिलाइटिंग के लिए मस्क्ड सेल्फ-कंडीशनिंग का उपयोग करता है

शोधकर्ताओं ने कार्य को समय-शर्तित लैटेंट डोमेन अनुवाद के रूप में फिर से परिभाषित करके लंबी अवधि के वीडियो रिलाइटिंग में कालिक असंततताओं को संबोधित किया। फ्रेमवर्क सीमाओं पर लक्ष्य-डोमेन लैटेंट को प्रसारित करके क्रॉस-चंक निरंतरता को लागू करता है और इस व्यवहार को सीखने योग्य बनाने के लिए मस्क्ड लक्ष्य-डोमेन सेल्फ-कंडीशनिंग का उपयोग करता है।

lab NVIDIA Research · 3 घंटे पहले · 2 बार देखा गया

Nvidia ने हाइब्रिड डोमेन नॉलेज फ्यूजन के माध्यम से रियल-टाइम पोर्ट्रेट रिलिटिंग के लिए FusionRelight प्रस्तुत किया

Nvidia के शोधकर्ताओं ने FusionRelight पेश किया है, जो एक विधि है जो भौतिक रूप से युक्तिसंगत प्रकाश स्थानांतरण को पहचान संरक्षण और संपीड़ित रियल-टाइम इनफरेंस के साथ जोड़ती है। यह दृष्टिकोण हाइब्रिड डोमेन नॉलेज फ्यूजन (HDKF) का उपयोग करता है, एक प्रशिक्षण ढांचा जो सिंथेटिक, वन-लाइट-एट-ए-टाइम (OLAT), और इन-द-वाइल्ड डेटा से भौतिकी, प्रतिबिंब और यथार्थता के पूर्वज्ञान को एक छात्र मॉडल में संक्षिप्त करता है।

github llama.cpp · 3 घंटे पहले · 1 बार देखा गया

llama.cpp b10431 ने SSM मॉडल के लिए पुनरावर्ती स्थिति रोलबैक जोड़ा है

llama.cpp परियोजना ने संस्करण b10431 जारी किया, जिसने ggml_ssm_scan संचालन में पुनरावर्ती स्थिति (RS) रोलबैक के लिए समर्थन पेश किया। इस बदलाव से CPU और CUDA बैकएंड पर Nemotron मॉडल के लिए RS रोलबैक सक्षम हो जाता है।

media TLDR AI · 4 घंटे पहले · 3 बार देखा गया

OpenAI ने GPT-5.6 Sol के लिए Ultrafast मोड का प्रीव्यू दिया; Google ने Gemini 3.7 Flash जारी किया

OpenAI ने Ultrafast का प्रीव्यू दिया है, जो GPT-5.6 Sol का एक मोड है जो प्रति सेकंड 750 आउटपुट टोकन उत्पन्न कर सकता है और मानक प्रसंस्करण गति की तुलना में 14 गुना तक की गति पर काम कर सकता है। इस दृष्टिकोण का उद्देश्य छोटे मॉडल में स्विच किए बिना रियल-टाइम प्रदर्शन प्रदान करना है।

media Hugging Face Forums · 4 घंटे पहले · 1 बार देखा गया

helloadhavan ने Common Crawl से संरचित Markdown निकालने के लिए CC-FilteredCorpus जारी किया

उपयोगकर्ता helloadhavan ने CC-FilteredCorpus नाम का एक डेटासेट बनाया है, जो Common Crawl को फ़िल्टर करने और सामग्री को साफ़ Markdown के रूप में निकालने के लिए डिज़ाइन किया गया है। परियोजना का उद्देश्य उपयोगी दस्तावेज़ संरचना को बनाए रखना है, जिसमें शीर्षक, सूचियाँ, लिंक, कोड ब्लॉक और तालिकाएं शामिल हैं, न कि सब कुछ को सादे पाठ में बदल देना।

media The Batch · 5 घंटे पहले Artificial Analysis Intelligence Index · 58.0% · 3 बार देखा गया

मेटा ने म्यूज़ कोड एजेंटिक हार्नेस और कम लागत वाला म्यूज़ स्पार्क 1.2 मॉडल जारी किया

मेटा ने म्यूज़ स्पार्क 1.2 मॉडल द्वारा संचालित, एक कमांड-लाइन एजेंटिक कोडिंग हार्नेस 'म्यूज़ कोड' का परिचय दिया। इस रिलीज़ में एक "योगदानकर्ता स्तर" शामिल है जो डेवलपर्स के लिए लागत को काफी कम करता है, जो मेटा को प्रशिक्षण के लिए अपनी इंटरैक्शन डेटा का उपयोग करने की अनुमति देते हैं।

github llama.cpp · 8 घंटे पहले · 1 बार देखा गया

llama.cpp b10429 llama_decode() के दौरान /metrics और /slots तक पहुंचने की अनुमति देता है

llama.cpp प्रोजेक्ट ने संस्करण b10429 जारी किया, जो सर्वर को संशोधित करता है ताकि llama_decode() चल रहे होने पर /metrics और /slots एंडपॉइंट्स तक पहुंच की अनुमति मिल सके।

github llama.cpp · 8 घंटे पहले · 1 बार देखा गया

llama.cpp b10430 आभासी igpu उपकरणों की अनुमति देता है

llama.cpp परियोजना ने संस्करण b10430 जारी किया है, जो आभासी एकीकृत GPU (igpu) उपकरणों के लिए समर्थन पेश करता है। इस अपडेट में कोडबेस के भीतर सुधारे गए कमेंट्स भी शामिल हैं।

media MarkTechPost · 10 घंटे पहले · 2 बार देखा गया

Z.ai ने पोस्ट-ट्रेनिंग के माध्यम से कोडिंग और साइबरसुरक्षा में सुधार के साथ GLM-5.3 जारी किया

Z.ai ने अपने 743B पैरामीटर मॉडल का अपडेट GLM-5.3 जारी किया है, जो बेस मॉडल के पुनः प्रशिक्षण के बजाय स्केल्ड पोस्ट-ट्रेनिंग के माध्यम से प्रदर्शन में वृद्धि हासिल करता है। रिलीज़ वर्तमान में Z.ai API, GLM कोडिंग प्लान और ZCode के माध्यम से उपलब्ध है, और सुरक्षा मूल्यांकन के बाद लगभग दो सप्ताह में पब्लिक वेट्स की रिलीज़ की योजना है।

media Hugging Face Forums · 10 घंटे पहले · 1 बार देखा गया

उत्पादन एजेंटिक सिस्टम बनाने से सीख

एक इंजीनियर उन आर्किटेक्चर और विफलता मोड का विवरण देता है जो प्रोजेक्ट्स को साधारण चैटबॉट्स से योजना, टूल उपयोग और मल्टी-स्टेप टास्क पूरा करने में सक्षम मजबूत एजेंटिक सिस्टम में स्थानांतरित करते समय सामने आए।

media r/LocalLLaMA · 11 घंटे पहले · 2 बार देखा गया

Qwen 3.8 Max रिलीज़ में योजना, सरलीकरण और प्रायोगिक डिज़ाइन पर जोर

Qwen 3.8 Max का पूर्ण रिलीज़ इस प्रारंभिक धारणा की पुष्टि करता है कि मॉडल असाधारण रूप से तेज़ है, योजना बनाने में अत्यधिक सक्षम है, और समस्याओं में अनावश्यक जटिलता को पहचानने में कुशल है।

github llama.cpp · 13 घंटे पहले · 1 बार देखा गया

llama.cpp b10427 SYCL FFN ऑप्स को फ्यूज़ करता है, थ्रूपुट में 12.4% तक वृद्धि

llama.cpp प्रोजेक्ट ने संस्करण b10427 जारी किया, जिसमें SYCL के माध्यम से Intel Arc GPUs के लिए एक प्रदर्शन अनुकूलन शामिल है। अपडेट q4_K घन फीड-फॉरवर्ड नेटवर्क (FFN) परत के भीतर gate, up और GLU ऑप्स के विलय को लागू करता है।