हाल ही के
776 →
Google ने Gemini 4 Argon मॉडल जारी किया
ट्रंप ने प्रौद्योगिकी नेताओं के साथ कृत्रिम बुद्धिमत्ता पर व्हाइट हाउस समझौते पर हस्ताक्षर किए
Claude Code v2.1.286 में प्रमाणीकरण, MCP और सबएजेंट संबंधी समस्याओं का समाधान
+773 और
Inference efficiency
272 →
llama.cpp b11284 में quantized weight views पर OpenVINO GET_ROWS की समस्या का समाधान
llama.cpp b11280 रिलीज में पिंडेड होस्ट बफर्स के साथ टेंसर ऑलरिड्यूक सिंक कम होता है
llama.cpp b11282 ने MUSA डिवाइस पास के लिए CUDA_ARCH परिभाषित किया
+269 और
AI agents
228 →
Claude Code v2.1.286 में प्रमाणीकरण, MCP और सबएजेंट संबंधी समस्याओं का समाधान
OpenAI ने Dots एजेंट्स, GPT-6.1 Sol और Decisions API पेश किए
AutoGPT Platform v0.8.2 में AutoPilot गेटिंग मोड और नए LLMs जोड़े गए
+225 और
API & product launches
127 →
Google ने Gemini 4 Argon मॉडल जारी किया
OpenAI ने Dots एजेंट्स, GPT-6.1 Sol और Decisions API पेश किए
Anthropic और OpenAI ने सस्ते मॉडल जारी किए; OpenAI ने नौ असंगतता घटनाओं का खुलासा किया
+124 और
Safety & alignment
101 →
OpenAI ने Moonshot AI से जुड़ी अभियान को बाधित किया जो संरक्षित तर्क निकाल रहा था
Anthropic और OpenAI ने सस्ते मॉडल जारी किए; OpenAI ने नौ असंगतता घटनाओं का खुलासा किया
Google DeepMind ने SynthID Bio का परिचय दिया ताकि AI-जनित प्रोटीन में वॉटरमार्क किया जा सके
+98 और
Local inference
95 →
llama.cpp b11284 में quantized weight views पर OpenVINO GET_ROWS की समस्या का समाधान
llama.cpp ने k-pool और MTP फिक्स के साथ GLM-5.3-Flash समर्थन जोड़ा
llama.cpp b11272 हेक्सगॉन कॉन्कैट ऑपरेशन को अनुकूलित करता है
+92 और
Open weights
77 →
Google DeepMind ने SynthID Bio का परिचय दिया ताकि AI-जनित प्रोटीन में वॉटरमार्क किया जा सके
शून्य-शॉट तालिका पूर्वानुमान के लिए NVIDIA ने खुला Kumo Tabular फाउंडेशन मॉडल जारी किया
H कंपनी ने डेस्कटॉप, वेब और मोबाइल के लिए Holo4 ओपन-वेट कंप्यूटर-यूज़ मॉडल जारी किए
+74 और
Code generation
75 →
Claude Code v2.1.286 में प्रमाणीकरण, MCP और सबएजेंट संबंधी समस्याओं का समाधान
AutoGPT Platform v0.8.2 में AutoPilot गेटिंग मोड और नए LLMs जोड़े गए
OpenAI ने एक-पाँचवां Astra के खर्च पर एजेंटिक कोडिंग के लिए GPT-6.1 Sol पेश किया
+72 और
Research paper
60 →
एजेंटिक मेटा-रिज़निंग स्पष्ट नियंत्रण के माध्यम से निष्कर्ष को स्केल करता है
RareDx ग्राउंडेड पॉलिसी ऑप्टिमाइज़ेशन का उपयोग कर दुर्लभ-रोग निदान में सुधार करता है
TokenProbe तर्क की गुणवत्ता को बनाए रखते हुए CoT टोकन उपयोग को 76% तक कम करता है
+57 और
Benchmark results
43 →
NVIDIA के शोधकर्ताओं ने Cosmos 3 वीडियो मॉडल में भौतिक तर्क को बेहतर बनाने के लिए Physis-Lang जारी किया
AI Compute Radar ने Heat Score के आधार पर Alibaba Qwen और Google को शीर्ष ओपन मॉडल लैबों में रैंक किया
Anthropic को पता चला कि GLM-5.3 साइबर रेड टीमिंग में पूर्ण कंट्रोल फ्लो हाइजैक प्राप्त करता है
+40 और
Evaluation & benchmarks
41 →
ओपन टीटीएस लीडरबोर्ड स्केलेबल मल्टीलिंगुअल टीटीएस इवैल्यूएशन को लांच करता है
स्वतंत्र शोधकर्ता ने IssueTrojanBench के 42 वास्तविक प्रॉम्प्ट-इनजेक्शन हमलों के खिलाफ Kavach का मूल्यांकन किया
अध्ययन से बहु-चरण LLM दूषण में ज्ञान नीति का विचलन सामने आया
+38 और
Training methods
33 →
संदर्भ भाषा मॉडल संदर्भ को संपादन योग्य फ़ाइलों के रूप में स्वतः प्रबंधित करते हैं
ROFT स्व-उत्पन्न व्याख्याओं पर फाइन-ट्यून करके एजेंटिक मॉडलों को बेहतर बनाता है
शोधकर्ता ज्ञान विलयन इंजीनियरी चुनौतियों के साथ उद्योग अनुभव की तलाश में है
+30 और
Hardware & chips
32 →
llama.cpp b11280 रिलीज में पिंडेड होस्ट बफर्स के साथ टेंसर ऑलरिड्यूक सिंक कम होता है
DeepSeek अब Ascend 950 पर मॉडल प्रशिक्षित कर रहा है
AI Hardware Fit मॉडल की VRAM आवश्यकताओं को GPU चयन से जोड़ता है
+29 और
Retrieval & RAG
31 →
Cohere ने Embed 5 Pro और Fast एम्बेडिंग मॉडल जारी किए
Perplexity ने Photon जारी किया, पुनर्प्राप्ति की p99 विलंबता को 800 ms से घटाकर 65 ms कर दिया
ProvenanceGuard ने MCP एजेंट्स में स्रोत-जागरूक सत्यापण जोड़ा है
+28 और
Multimodal
28 →
माइक्रोसॉफ्ट रिसर्च ने क्वाइन पेश किया, बहुमोडल जैविक शोध के लिए एक एआई सिस्टम
llama.cpp b11240 में /v1/embeddings के लिए टाइप्ड मल्टीमोडल इनपुट सपोर्ट जोड़ा गया
स्नातक छात्र दृश्य हस्तक्षेप को रोकने के लिए Qwen 2.5 Omni 3B में वास्तुकला परिवर्तन का प्रस्ताव देता है
+25 और
Voice & audio
28 →
ओपन टीटीएस लीडरबोर्ड स्केलेबल मल्टीलिंगुअल टीटीएस इवैल्यूएशन को लांच करता है
अलibaba क्वेन ने क्वेन-ऑडियो-3.1-रियलटाइम फुल-डप्लेक्स वॉइस मॉडल जारी किया
llama.cpp b11190 ने LFM2 ऑडियो में mel प्रीप्रोसेसर को ठीक किया
+25 और
Policy & regulation
21 →
ट्रंप ने प्रौद्योगिकी नेताओं के साथ कृत्रिम बुद्धिमत्ता पर व्हाइट हाउस समझौते पर हस्ताक्षर किए
अलाइनमेंट विफलताओं के कारण OpenAI ने Astra 6.1 रिलीज़ रद्द की
लेन्फेस्ट इंस्टीट्यूट ने $5M ओपनएआई फंडिंग के साथ एआई फेलोशिप का विस्तार किया
+18 और
Image generation
14 →
AutoRef बहु-संदर्भित छवि जनरेशन के लिए एजेंटिक हार्नेस को अनुकूलित करता है
हंग ट्रान ओवरफिट्ड न्यूरल इमेज कोडेक्स में क्लिपिंग ट्राप की पहचान करते हैं
मेटा ने Muse कनेक्टर खोले, SAM 3.1 जारी किया, और Gemini ने सिस्टम हैक किए
+11 और
Video generation
13 →
NVIDIA के शोधकर्ताओं ने Cosmos 3 वीडियो मॉडल में भौतिक तर्क को बेहतर बनाने के लिए Physis-Lang जारी किया
Google Research ने सहसंबद्ध, मिनटों तक चलने वाले वीडियो निर्माण के लिए 4 एजेंटिक फ्रेमवर्क पेश किए
Runway ने रियल-टाइम इंटरैक्टिव वर्ल्ड जनरेशन के लिए WorldPrompt पेश किया
+10 और
Reasoning models
11 →
TokenProbe सटीकता को बनाए रखते हुए CoT टोकन उपयोग को 76% कम करता है
TelecomGPT-R1: विविध टेलीकॉम कार्यों में तर्क के लिए एकीकृत पोस्ट-ट्रेनिंग
CosmicUndercurrent ने LLM whole-system coordination का परीक्षण करने के लिए Principia-Structurae-Realitatis जारी किया
+8 और