विषय · Retrieval & RAG
lab OpenAI News · 20 दिन पहले · 35 बार देखा गया

OpenAI ने वित्तीय सेवाओं के लिए GPT-6 Astra और इनबिल्ट डेटा के साथ ChatGPT पेश किया

OpenAI ने वित्तीय सेवाओं के लिए ChatGPT लॉन्च किया है, जो शोध, मॉडलिंग और क्लाइंट सामग्री निर्माण में टीमों की सहायता करने के लिए GPT-6 Astra तर्कशक्ति को इनबिल्ट प्रीमियम वित्तीय डेटा के साथ जोड़ने वाला एक अनुकूलित अनुभव है। इस उत्पाद का विकास निवेश बैंकिंग और इक्विटी शोध में प्रमुख चुनौतियों को दूर करने के लिए Morgan Stanley और Evercore के साथ साझेदारी में किया गया था।

lab OpenAI News · 9 दिन पहले · 31 बार देखा गया

V7 AI एजेंट्स को संस्थागत स्मृति देने के लिए GPT-6 Astra का उपयोग कर रहा है

V7 ने OpenAI के GPT-6 Astra को अपनी V7 Go प्लेटफ़ॉर्म में एकीकृत किया है ताकि Context Graph के माध्यम से AI एजेंट्स को स्थिर "संस्थागत स्मृति" प्रदान की जा सके, जिससे जटिल उद्योग पूछताछों पर पुनर्प्राप्ति सटीकता में महत्वपूर्ण सुधार हुआ है।

lab Google — The Keyword (AI) · 13 दिन पहले · 27 बार देखा गया

संयुक्त राष्ट्र वैश्विक सांख्यिकी को एकीकृत करने के लिए System Data Commons शुरू करता है

संयुक्त राष्ट्र प्रणाली Google's Data Commons पर बनाई गई एक ओपन-सोर्स प्लेटफ़ॉर्म UN System Data Commons शुरू कर रही है, जो वैश्विक सांख्यिकी को AI-तैयार ज्ञान ग्राफ के रूप में जाना जाने वाले एकल इंटरकनेक्टेड संसाधन में जोड़ती है। Google.org के समर्थन से, परियोजना महत्वपूर्ण डेटा को सार्वभौमिक रूप से सुलभ बनाने और वास्तविक समय में वैश्विक प्रगति को ट्रैक करने में मदद करने का लक्ष्य रखती है।

lab OpenAI News · 29 दिन पहले · 28 बार देखा गया

OpenAI ने ChatGPT में Epic EHR इंटीग्रेशन और हेल्थकेयर पब्लिक डेटा प्लगइन जोड़ा

OpenAI ने एक नई इंटीग्रेशन पेश की है जिससे स्वास्थ्य संगठन Epic इलेक्ट्रॉनिक हेल्थ रिकॉर्ड्स से अनुमतित मरीज के संदर्भ को ChatGPT for Healthcare में जोड़ सकते हैं, साथ ही एक हेल्थकेयर पब्लिक डेटा प्लगइन भी है जो आधिकारिक डेटासेट तक संरचित पहुंच प्रदान करता है।

github LlamaIndex · 9 दिन पहले · 17 बार देखा गया

Llama Index v0.14.25 सुरक्षा चेतावनियों को हल करता है और एसींक्रोनस समर्थन जोड़ता है

Llama Index ने 21 सितंबर, 2026 को संस्करण 0.14.25 जारी किया, मुख्य रूप से अपने इकोसिस्टम में व्यापक सुरक्षा कमजोरियों को दूर करने के लिए।

lab Cohere Blog · 2 घंटे पहले

Cohere ने Embed 5 Pro और Fast एम्बेडिंग मॉडल जारी किए

Cohere ने Embed 5 जारी किया है, जो प्रीमियर एम्बेडिंग मॉडल्स का एक नया परिवार है जो Cohere API, Microsoft Foundry और Amazon SageMaker पर Pro और Fast टियर्स में उपलब्ध है। दोनों टियर्स एक ही एम्बेडिंग स्पेस साझा करते हैं, जिससे टीमों को अधिकतम गुणवत्ता के लिए Pro के साथ इंडेक्स बनाने और कम लेटेंसी व लागत के लिए Fast के साथ क्वेरी करने की सुविधा मिलती है, बिना इंडेक्स को फिर से बनाए।

media MarkTechPost · 7 घंटे पहले · 4 बार देखा गया

Perplexity ने Photon जारी किया, पुनर्प्राप्ति की p99 विलंबता को 800 ms से घटाकर 65 ms कर दिया

Perplexity ने Photon जारी किया है, एक आंतरिक Rust-आधारित पुनर्प्राप्ति और रैंकिंग इंजन जो अब सभी उत्पादन ट्रैफिक संभाल रहा है, जिसने पहले फोर्क किए गए ओपन-सोर्स घटक को प्रतिस्थापित किया है। नया सिस्टम Perplexity Search API में एक "Fast Search" मोड सक्षम करता है, जो एजेंटिक वर्कफ़्लो के लिए काफी कम विलंबता प्रदान करता है।

lab Hugging Face Blog · 1 दिन पहले · 1 बार देखा गया

ProvenanceGuard ने MCP एजेंट्स में स्रोत-जागरूक सत्यापण जोड़ा है

ProvenanceGuard एक पोस्ट-जनरेशन सत्यापण परत है जो Model Context Protocol (MCP) एजेंट्स के लिए है और यह सुनिश्चित करके क्रॉस-स्रोत मिश्रण का पता लगाती है कि दावों को सही प्रमाण स्रोत से जोड़ा गया हो। सिस्टम MCP ट्रेस का विश्लेषण करता है बिना एजेंट को पुनः प्रशिक्षित किए, उत्तरों को दावों में तोड़ता है और सत्यापित करता है कि सहायक स्रोत वह मेल खाता है जो आउटपुट में नामित या संकेतित किया गया था।

arxiv arXiv cs.AI · 1 दिन पहले · 1 बार देखा गया

RareDx ग्राउंडेड पॉलिसी ऑप्टिमाइज़ेशन का उपयोग कर दुर्लभ-रोग निदान में सुधार करता है

लेखकों ने RareDx पेश किया, एक सिस्टम जो नियंत्रित प्रमाण उपयोग को ज्ञान-ग्राफ-ग्राउंडेड पॉलिसी ऑप्टिमाइज़ेशन के साथ जोड़ता है दुर्लभ-रोग निदान की लंबी-छाया तर्क समस्या को हल करने के लिए। प्रशिक्षण पाइपलाइन Top-10 पोस्ट-ट्रेनिंग को RareDx-KGPO के साथ जोड़ती है, जो भविष्यवाणियों को एक मानकीकृत रोग ग्राफ में प्रोजेक्ट करता है और संपादित स्तरित प्रासंगिकता, ऑन्टोलॉजी निकटता, बायोमेडिकल समानता, और लक्षण स्थिरता को एकीकृत करता है।

media Hugging Face Forums · 2 दिन पहले · 2 बार देखा गया

Grok ने बिना पूछे Covenant परियोजना को रॉबर्ट हैन्सन के कार्य से जोड़ा

पियर-टू-पियर लेजर "Covenant" के लेखक ने रिपोर्ट की कि X पर Grok ने बिना किसी प्रॉम्प्ट या पूर्व उल्लेख के स्वतंत्र रूप से उनकी परियोजना की तुलना रॉबर्ट "Grizzly" Hanson के कार्य से की। यह वह तीसरा मामला है जहां एक AI सिस्टम ने बिना अनुरोध किए Covenant को बाहरी कार्य से जोड़ा।

arxiv arXiv cs.AI · 3 दिन पहले · 15 बार देखा गया

Highlight-Then-Summarize प्रमाण को संपीड़ित करके लंबे संदर्भ की समझ में सुधार करता है

शोधकर्ताओं ने Highlight-Then-Summarize (H2S) का प्रस्ताव दिया, जो एक compress-then-reason अंतर्दृष्टि है जो प्रश्न-संबंधी प्रमाण की पहचान करती है और उत्तर उत्पन्न करने से पहले उसे एक संपीड़ित सारांश में एकीकृत करती है। टीम ने H2S-Dataset का निर्माण 6,647 उदाहरणों के साथ किया और प्रमाण चयन के लिए प्रक्रिया-स्तर पुरस्कार प्रदान करने के लिए H2S-RL को पेश किया।

arxiv arXiv cs.CL · 3 दिन पहले · 6 बार देखा गया

Highlight-Then-Summarize लंबे संदर्भ की बेहतर समझ के लिए प्रमाण को संपीड़ित करता है

शोधकर्ताओं ने Highlight-Then-Summarize (H2S) का प्रस्ताव रखा, जो एक compress-then-reason परिप्रेक्ष्य है जो प्रश्न-संबंधी प्रमाण की पहचान करता है और उत्तर उत्पन्न करने से पहले उसे एक संक्षिप्त सारांश में एकीकृत करता है। इस दृष्टिकोण का समर्थन करने के लिए, टीम ने 11 बेंचमार्क परिवारों से 6,647 उदाहरणों के साथ H2S-Dataset तैयार किया और प्रक्रिया-स्तर के पुरस्कारों के लिए H2S-RL पेश किया।

arxiv arXiv cs.CL · 3 दिन पहले · 7 बार देखा गया

पुराने दस्तावेज़ों का विषाक्तकरण पुरानी पुनर्प्राप्ति को सही मॉडल उत्तरों पर हावी बना देता है

शोधकर्ताओं ने "स्टेल-डॉक्यूमेंट पॉइजनिंग" की पहचान की, जो रेट्रीवल-एम्बेडेड जनरेशन (RAG) में एक समयिक संरेखण विफलता है, जहां पुराना बाहरी प्रमाण मॉडलों को गलत उत्तर देने पर मजबूर करता है, भले ही वे बिना पुनर्प्राप्ति के सही उत्तर जानते हों।

arxiv arXiv cs.CL · 3 दिन पहले · 7 बार देखा गया

KuaFu अरब स्केल पर उपयोगकर्ता व्यवहार को समझ में संपीड़ित करता है

Tencent ने KuaFu पेश किया, एक एकीकृत व्यवहार-संपीड़न परत जो कच्चे उपयोगकर्ता इतिहास को संवादात्मक एजेंट्स और सिफारिशकर्ताओं के लिए संपीड़ित निरूपण में बदल देती है। सिस्टम प्रत्येक व्यवधान आइटम को 128-256 चौड़ाई के 2-4 टोकन में संपीड़ित करने के लिए दो-अक्ष प्रोजेक्टर का उपयोग करता है, एक अरब उपयोगकर्ताओं के लिए लंबी अनुक्रमों के प्रसंस्करण में बाधाओं को दूर करता है।

media Hugging Face Forums · 3 दिन पहले · 5 बार देखा गया

जैविक JEPA मॉडल रोग की प्रगति को मॉडल करने के लिए जैविक बाधाओं का उपयोग करते हैं

बायोलॉजिकल JEJA नामक एक नया ओपन-सोर्स प्रोजेक्ट JEPA-शैली प्रतिनिधित्व सीखने को जैविक बाधाओं के साथ जोड़ता है ताकि यह मॉडल किया जा सके कि रोग समय के साथ कैसे आगे बढ़ते हैं। इस दृष्टिकोण का परीक्षण 2,347 रोगियों से वास्तविक ADNI डेटा पर किया गया और कई अन्य मॉडलों के साथ तुलना की गई।

arxiv arXiv cs.CL · 7 दिन पहले · 6 बार देखा गया

R3Con बड़े पैमाने के तर्क को बेहतर बनाने के लिए प्रासंगिकता साकारकरण सिद्धांतों को लागू करता है

शोधकर्ताओं ने R3Con का प्रस्ताव रखा है, जो बहुत बड़े संदर्भों की प्रभावी प्रतिनिधित्व बनाने के लिए संज्ञानात्मक सिद्धांत के सिद्धांतों को क्रियान्वित करता है। यह प्रणाली मानक मॉडल संदर्भ सीमाओं से परे विशाल स्रोतों में बिखरी हुई अंतर्निर्भर जानकारी को जोड़ने की चुनौती को संबोधित करती है।

media Together AI Blog · 7 दिन पहले · 3 बार देखा गया

Together AI Qwen3.5 4B पर Jev-जैसी क्लासिफायर को $17 में फाइन-ट्यून करने की सुविधा देता है

Together AI ने Qwen3.5 4B बेस मॉडल का उपयोग करके Jev के समान एक वर्गीकरण मॉडल को फाइन-ट्यून करने के लिए एक गाइड और ओपन-सोर्स रिपॉजिटरी जारी की है।

media Hugging Face Forums · 9 दिन पहले · 12 बार देखा गया

YUCLAW 8.0.0 में पुनरुत्पादक प्रमाण डेमो के लिए स्पष्ट स्नैपशॉट मोड जोड़ा गया

YUCLAW 8.0.0 यह सुनिश्चित करने के लिए एक स्पष्ट स्नैपशॉट मोड पेश करता है कि कमांड-लाइन इंटरफ़ेस डेमो होस्ट पर्यावरण की नेटवर्क कनेक्टिविटी से स्वतंत्र रूप से बाइट-सटीक, पुनरुत्पादक आउटपुट उत्पन्न करें।

media Hugging Face Forums · 9 दिन पहले · 14 बार देखा गया

jbsalles LLMs के लिए SelMem, एक चयनात्मक स्मृति प्रणाली का परीक्षण कर रहे हैं

लेखक ने बड़े भाषा मॉडलों (LLMs) के लिए अपूर्ण और पथ-निर्भर स्मृति का परीक्षण करने के लिए SelMem नामक एक Rust प्रोजेक्ट विकसित किया है। यह दृष्टिकोण मानव स्मृति की नकल करता है, एजेंट्स को समय के साथ इंटरैक्शन की पूर्ण प्रतियां स्टोर करने के बजाय स्मृतियों को संकुचित, भूलने और पुनर्निर्मित करने की अनुमति देता है।

media Hugging Face Forums · 11 दिन पहले · 13 बार देखा गया

सेमांटिक रूटिंग ने 14K संदर्भ तनाव परीक्षण में Qwen2.5 इनपुट टोकन को 41% और अग्रिम समय को 45% कम किया

HotpotQA ब्रिज प्रश्नों पर फ्रोजन 4-बिट Qwen2.5-7B-Instruct का उपयोग करके किए गए GPU तनाव परीक्षण से पता चलता है कि कार्य-जागरूक सेमांटिक रूटिंग उच्च-भ्रामक स्थितियों के तहत दक्षता और सटीकता को काफी बढ़ाती है। अध्ययन ने पूर्ण कैप्ड संदर्भ की तुलना एक क्वेरी-जागरूक सेमांटिक चयनकर्ता से की, जो बजट का 60% बनाए रखता है, जिसमें गति और सटीकता में महत्वपूर्ण सुधार दिखा।