हाल ही के
798 →
llama.cpp b10437 ने MiniMax-Text-01 और MiniMax-M1 मॉडलों के लिए समर्थन जोड़ा है
OpenAI Python SDK v0.21.0 में प्रोवाइडर-तटस्थ परीक्षण APIs और OpenAI v3 संगतता जोड़ी गई
llama.cpp b10435 ने jinja gather_string_parts में द्विघात लागत को ठीक किया
+795 और
AI agents
247 →
OpenAI Python SDK v0.21.0 में प्रोवाइडर-तटस्थ परीक्षण APIs और OpenAI v3 संगतता जोड़ी गई
Claude Code v2.1.233 में GitLab MR समर्थन, मेमोरी सीमाएं जोड़ी गईं और नए मॉडल पर todo टूल्स अक्षमित किए गए
OpenAI ने GPT-5.6 Sol के लिए Ultrafast मोड का प्रीव्यू दिया; Google ने Gemini 3.7 Flash जारी किया
+244 और
Inference efficiency
184 →
llama.cpp b10437 ने MiniMax-Text-01 और MiniMax-M1 मॉडलों के लिए समर्थन जोड़ा है
llama.cpp b10435 ने jinja gather_string_parts में द्विघात लागत को ठीक किया
llama.cpp b10434 टेम्पलेट्स को reasoning_effort पास करता है
+181 और
Open weights
166 →
Z.ai ने GLM-5.3 को विस्तारित पोस्ट-ट्रेनिंग के साथ जारी किया
ओपन मॉडल्स की स्थिति: गर्मियों 2026 के अवलोकन
Qwen ने Qwen 3.8 27B के लिए ओपन वेट्स जारी किए
+163 और
API & product launches
114 →
OpenAI Python SDK v0.21.0 में प्रोवाइडर-तटस्थ परीक्षण APIs और OpenAI v3 संगतता जोड़ी गई
xAI ने GitHub Copilot में Grok 4.6 कोडिंग मॉडल जारी किया
OpenAI ने GPT-5.6 Sol के लिए Ultrafast मोड का प्रीव्यू दिया; Google ने Gemini 3.7 Flash जारी किया
+111 और
Code generation
95 →
Claude Code v2.1.233 में GitLab MR समर्थन, मेमोरी सीमाएं जोड़ी गईं और नए मॉडल पर todo टूल्स अक्षमित किए गए
xAI ने GitHub Copilot में Grok 4.6 कोडिंग मॉडल जारी किया
मेटा ने म्यूज़ कोड एजेंटिक हार्नेस और कम लागत वाला म्यूज़ स्पार्क 1.2 मॉडल जारी किया
+92 और
Safety & alignment
77 →
क्लाउड एनएआई अधिनियम के अनुपालन के लिए SynthID-Text वॉटरमार्किंग लागू करता है
Muse-Ltd ने LLM ज्ञानात्मक कैलिब्रेशन के लिए UncertaintyGym बेंचमार्क सबमिट किया
OpenAI के एजेंट्स ने गलती से Artifactory के माध्यम से Hugging Face पर हमला किया
+74 और
Research paper
74 →
HorizonRelight लंबी अवधि के वीडियो रिलाइटिंग के लिए मस्क्ड सेल्फ-कंडीशनिंग का उपयोग करता है
Faraday 27B ने कागजात प्रतिकृति कार्यों में Claude Opus 4.8 और GPT-5.5 को पछाड़ दिया
Faraday 27B ने लेख प्रतिकृति कार्यों में Claude Opus 4.8 और GPT-5.5 को पार कर लिया
+71 और
Benchmark results
58 →
Z.ai ने GLM-5.3 को विस्तारित पोस्ट-ट्रेनिंग के साथ जारी किया
Qwen ने ModelScope और Hugging Face पर Qwen3.8-27B मॉडल जारी किया
Gemini 3.7 Flash अपडेट GDM को फिर से प्रमुखता में लाता है
+55 और
Local inference
51 →
llama.cpp b10434 टेम्पलेट्स को reasoning_effort पास करता है
ओपन मॉडल्स की स्थिति: गर्मियों 2026 के अवलोकन
llama.cpp b10418 ने SYCL के लिए होस्ट पिंडेड मेमोरी समर्थन जोड़ा है
+48 और
Training methods
44 →
ThetaMem स्थिर-अवस्था क्रम स्मृति के लिए हस्ताक्षरित गुणात्मक कुंजी उन्नयन प्रस्तावित करता है
Dyna Robotics ने 1 मिलियन घंटे के मानवीय वीडियो पर पूर्व-प्रशिक्षित किया Dyna-2, एक विश्व-क्रिया मॉडल
LLM हाइपरपैरामीटर ऑप्टिमाइज़ेशन में बेयसियन ऑप्टिमाइज़ेशन के बराबर या बेहतर हैं
+41 और
Multimodal
40 →
Intern-S2-Preview: वैज्ञानिक एजेंटिक फाउंडेशन मॉडल
dots-studio ने 280B MoE मॉडल dots3-note preview जारी किया
Liquid AI ने LFM2.5-VL-3B जारी किया, जो टूल कॉलिंग के साथ एक 3B ऑन-डिवाइज विजन-लैंग्वेज मॉडल है
+37 और
Policy & regulation
37 →
क्लाउड एनएआई अधिनियम के अनुपालन के लिए SynthID-Text वॉटरमार्किंग लागू करता है
व्हाइट हाउस एआई नीति का विस्तार करेगा, संभवतः ओपन मॉडल जोड़कर
Anthropic, OpenAI, Google, Meta, Microsoft और Mistral ने EU AI पारदर्शिता कोड पर हस्ताक्षर किए
+34 और
Evaluation & benchmarks
33 →
उत्पादन एजेंटिक सिस्टम बनाने से सीख
Muse-Ltd ने LLM ज्ञानात्मक कैलिब्रेशन के लिए UncertaintyGym बेंचमार्क सबमिट किया
ICML 2026 ओपन रिप्रोडक्शंस चैलेंज में पाए गए अध्ययन पत्रों के 23% में झूठे दावे हैं
+30 और
Hardware & chips
20 →
अलibaba ने NVIDIA GB300 NVL72 के लिए Qwen3.8-2.4T-A95B ओपन वेट्स जारी किए
RunSnack एक लिंक के माध्यम से P2P GPU साझाकरण सक्षम बनाता है
llama.cpp b10306 में SYCL GLU फ्लैट पथ जोड़ा गया और कर्नेल संघीकृत किए गए
+17 और
Robotics
19 →
Strands Agents LeRobot और Hugging Face Storage Buckets को जोड़ता है ताकि रोबोट डेटा के लिए निरंतर लूप बनाया जा सके
Dyna Robotics ने 1 मिलियन घंटे के मानवीय वीडियो पर पूर्व-प्रशिक्षित किया Dyna-2, एक विश्व-क्रिया मॉडल
Calibra रोबोट-लर्निंग डेटासेट में समस्याओं का पता लगाता है
+16 और
Retrieval & RAG
16 →
VITA क्लिनिकल RAG HealthBench पर फ्रंटियर LLMs के बराबर या बेहतर प्रदर्शन करता है
HealthBench पर Corpus-विशिष्ट VITA RAG फ्रंटियर LLMs के बराबर या बेहतर
HealthBench पर VITA क्लिनिकल RAG सिस्टम फ्रंटियर LLMs के बराबर या बेहतर है
+13 और
Video generation
15 →
HorizonRelight लंबी अवधि के वीडियो रिलाइटिंग के लिए मस्क्ड सेल्फ-कंडीशनिंग का उपयोग करता है
LTX ने स्थानीय वीडियो निर्माण के लिए खुले वजन वाले विश्व मॉडल LTX-2.5 को जारी किया
MiniMax ने समन्वित ऑडियो के साथ ओपन-वेइट H3 वीडियो मॉडल जारी किया
+12 और
Voice & audio
13 →
llama.cpp b10369 में pocket-tts समर्थन जोड़ा गया है, CUDA जनरेशन 80% तेज
NVIDIA Magpie TTS में अरबी, कोरियाई, पुर्तगाली जोड़े गए और गुणवत्ता में सुधार
NVIDIA ने NemotronLabs VoiceChat 11B जारी किया, जो ~450 ms टर्न-टेकिंग के साथ एक खुला फुल-डप्लेक्स स्पीच-टू-स्पीच मॉडल है
+10 और
Reasoning models
13 →
अनुसंधानकर्ता रीप्ले अटैक के माध्यम से प्रोप्राइटरी LLM API से तर्क ट्रेस चुराते हैं
शोधकर्ताओं ने क्लॉड, जीपीटी और जेमिनी एपीआई से एन्क्रिप्टेड तर्क ट्रेस को डीकोड किया
शोधकर्ता क्रॉस-सेशन एन्क्रिप्शन पुन: उपयोग का लाभ उठाकर LLM API से तर्क ट्रेस चुराते हैं
+10 और