Retrieval & RAG
media Hugging Face Forums · 3 दिन पहले

अलेथियन ने एएसएम-सीएम जारी किया, जो स्थिर एआई एजेंट्स के लिए एक संक्षिप्त मेमोरी आर्किटेक्चर है

अलेथियनएजी के फेलिपे माया मुनिज़ ने एएसएम-सीएम (अलेथियन कॉम्पैक्ट मेमोरी मॉडल) का परिचय दिया, जो एक प्रायोगिक आर्किटेक्चर है जो एजेंट के इतिहास को बढ़ते सक्रिय कंप्यूटेशनल मेमोरी के बिना बढ़ने की अनुमति देने के लिए मेमोरी को भाषा से अलग करता है।

media Hugging Face Forums · 6 दिन पहले · 3 बार देखा गया

IntelShed हाइब्रिड RAG, GNN एंटिटी रिज़ॉल्यूशन, फेडेरेटेड लर्निंग और LLM मल्टी-एजेंट ऑर्केस्ट्रेशन को जोड़ता है

लेखक ने ओपन-सोर्स इंटेलिजेंस (OSINT) के लिए एक ओपन-सोर्स सिस्टम IntelShed प्रस्तुत किया है, जो स्वचालित 24-घंटे की सुरक्षा ब्रीफिंग तैयार करने के लिए 50 सार्वजनिक डेटा फ़ीड को एकीकृत करता है। आर्किटेक्चर हाइब्रिड रिट्रीवल, GNN-आधारित एंटिटी रिज़ॉल्यूशन, डिफरेंशियल प्राइवेसी के साथ फेडेरेटेड लर्निंग और LLM-कंपाइल्ड मल्टी-एजेंट ऑर्केस्ट्रेशन को एकीकृत करता है।

media Hugging Face Forums · 10 दिन पहले · 1 बार देखा गया

TIS 2.0 टोकन महत्व स्कोर के साथ पृष्ठों को पुनः क्रमित करके RAG में स्थिति पूर्वाग्रह को समाप्त करता है

TIS 2.0 अपडेट एक पृष्ठ पुनः क्रमिकरण क्षमता प्रस्तुत करता है जो अतिरिक्त प्रशिक्षण की आवश्यकता के बिना प्राप्ति-संवर्धित उत्पादन में "बीच में खोया हुआ" स्थिति पूर्वाग्रह को समाप्त करता है। प्राप्त दस्तावेजों को पुनः क्रमित करने के लिए सीखे गए टोकन महत्व स्कोर लागू करके, सिस्टम शून्य स्थिति अंतर प्राप्त करता है और आधार रेखाओं की तुलना में सटीक मिलान सटीकता को 5 प्रतिशत बिंदु से बढ़ाता है।

media Hugging Face Forums · 12 दिन पहले · 1 बार देखा गया

ध्यान-वजनित मेमोरी ग्राफ़ graph-RAG ट्रावर्सल के लिए Jina ध्यान का उपयोग करता है

एक नया प्रस्ताव एक LLM मेमोरी संरचना को रेखांकित करता है जो लेट चंकिंग को ध्यान-वजनित किनारों के साथ जोड़ता है ताकि चरण-दर-चरण ट्रावर्सल सक्षम हो। सिस्टम Jina AI के एम्बेडिंग मॉडल का लाभ उठाता है, जो वाक्यों के बीच ध्यान की गणना करता है, दस्तावेज़ के आंतरिक प्रसंस्करण से किनारे के वजन निकालने के लिए।

media Hugging Face Forums · 13 दिन पहले · 2 बार देखा गया

DESi Review: संरचित ज्ञानवादी पत्र समीक्षा के लिए स्थापनीय Claude कौशल

लेखक ने DESi Review जारी किया है, जो एक व्यावहारिक अनुप्रयोग है मॉडल-स्वतंत्र DESi ज्ञानवादी शासन ढांचे का, जिसे एक स्थापनीय Claude कौशल के रूप में पैकेज किया गया है। यह उपकरण निर्धारक दावा निष्कर्षण को मॉडल-आधारित निर्णय से अलग करके अंग्रेजी पाठ पर एक संरचित पत्र-समीक्षा पाइपलाइन चलाता है।

media Hugging Face Forums · 16 दिन पहले · 1 बार देखा गया

7B–14B पैरामीटर वाले डोमेन-विशिष्ट LLMs के उत्पादन योग्यता पर सामुदायिक चर्चा

एक Hugging Face फोरम उपयोगकर्ता जांच रहा है कि क्या 7B–14B पैरामीटर रेंज में छोटे, डोमेन-विशिष्ट बड़े भाषा मॉडल (LLMs) वास्तविक दुनिया के उत्पादन वातावरण में बड़े मॉडलों का प्रभावी रूप से स्थान ले सकते हैं।

media Hugging Face Forums · 17 दिन पहले

विश्लेषक स्वतः कोडक के साथ ELIZA

ELIZA चैटबॉट का एक नया कार्यान्वयन संवादन प्रविष्टियों को एक लीन मेमोरी परत में संग्रहीत करने के लिए स्पार्स ऑटोएन्कोडर आर्किटेक्चर का उपयोग करता है, जो पारंपरिक कीवर्ड-मैचिंग विधियों में सुधार करने का प्रयास करता है। सिस्टम 32,768-न्यूरॉन मेमोरी परत के साथ एक T5 एन्कोडर-डीकोडर संरचना का उपयोग करता है, जहाँ समान प्रविष्टियाँ कंट्रास्टिव लर्निंग के माध्यम से सक्रिय होती हैं।

media r/LocalLLaMA · 17 दिन पहले · 3 बार देखा गया

PaddlePaddle ने HPD-Parsing जारी किया, एक 1B मॉडल जो हियरार्किकल पैरेलल डिकोडिंग के साथ आता है

PaddlePaddle ने HPD-Parsing का परिचय दिया, एक हल्का 1-अरब पैरामीटर दस्तावेज़ पार्सिंग मॉडल जो थ्रूपुट में सुधार के लिए हियरार्किकल पैरेलल डिकोडिंग पैराडाइम का उपयोग करता है। आर्किटेक्चर मुख्य लेआउट ब्रांच के माध्यम से वैश्विक पेज संरचना को समन्वयित करता है, जबकि स्थानीयकृत सामग्री उत्पादन को समानांतर ब्रांचों में भेजता है, डिकोडिंग चरणों को कम करने के लिए प्रोग्रेसिव मल्टी-टोकन प्रिडिक्शन का उपयोग करते हुए।

media Hugging Face Forums · 18 दिन पहले · 1 बार देखा गया

लेखक स्थानीय LLMs में प्रमाण संतृप्ति के लिए खुले k रजिस्ट्री का प्रस्ताव देता है

लेखक ने भाषा मॉडल के प्रमाण संतृप्ति बिंदु (k*) को मापने के लिए Hugging Face पर एक पायलट पेपर और एक खुली रजिस्ट्री प्रकाशित की है। यह मेट्रिक प्रॉम्प्ट्स में इंजेक्ट करने के लिए प्रमाण खंडों की इष्टतम संख्या निर्धारित करता है, क्योंकि अधिक संदर्भ जोड़ने से सटीकता एकवचन रूप से नहीं बढ़ती और लागत या ज्ञानात्मक दूषित होना बढ़ सकता है।

media Hugging Face Forums · 22 दिन पहले · 3 बार देखा गया

पदानुक्रमित एजेंटिक मेमोरी संरचित पुनर्प्राप्ति के लिए हाइपरबोलिक एम्बेडिंग का उपयोग करती है

एक नई मेमोरी आर्किटेक्चर "अमूर्तिकरण स्कोर" द्वारा सदिश डेटाबेस प्रविष्टियों को संगठित करने के लिए हाइपरबोलिक एम्बेडिंग का उपयोग करती है, जिससे एजेंट चपटा RAG सिस्टम की तुलना में ज्ञान को अधिक प्रभावी ढंग से प्रबंधित कर सकते हैं। यह दृष्टिकोण डेटा को इस प्रकार संरचित करता है कि प्राथमिकताओं जैसे अमूर्त प्रविष्टियाँ केंद्र के पास रहती हैं जबकि ठोस घटनाएँ सीमा पर स्थित होती हैं, जिससे बेहतर क्लस्टरिंग और पुनर्प्राप्ति सुगम होती है।

media Hugging Face Forums · 23 दिन पहले

ShinBay-UCTF गोपनीयता-संरक्षित निरंतर शिक्षण और संपीड़ित ज्ञान के लिए एक अवधारणात्मक ढांचे का प्रस्ताव रखता है

K7007 ने ShinBay-UCTF प्रस्तुत किया, जो बहुभाषी अतिरेक, स्थायी घटनात्मक स्मृति और निरंतर अनुकूलन के संबंध में AI प्रणालियों की सीमाओं को दूर करने वाला एक अवधारणात्मक ढांचा है। इस प्रस्ताव में तीन परस्पर क्रियाशील परतों से मिलकर बनी एक एकीकृत वास्तुकला का विवरण दिया गया है: Universal Compressed Training Format (UCTF), जैविक प्रेरित घटनात्मक स्मृति, और पर्यावरण-संचालित निरंतर शिक्षण।

arxiv arXiv cs.AI · 23 दिन पहले · 1 बार देखा गया

RAGU ने संपाक Meno-Lite-0.1 एक्सट्रैक्टर के साथ बहु-चरण GraphRAG इंजन पेश किया

RAGU एक ओपन-सोर्स मॉड्यूलर GraphRAG इंजन है जो इकाई निष्कर्षण को संघीकरण से अलग करके संरचित ज्ञान एकीकरण में सुधार करता है। यह सिंगल-पास सिस्टम में पाए जाने वाले शोर और भंगुरता को कम करने के लिए दो-चरण टाइप्ड निष्कर्षण प्रक्रिया, DBSCAN-सहायक डुप्लिकेट हटाना, LLM सारांशन, और Leiden समुदाय निदान का उपयोग करता है।

lab Hugging Face Blog · 24 दिन पहले · 8 बार देखा गया

NVIDIA ने RTEB पर #1 स्थान हासिल करने वाले Nemotron 3 Embed मॉडल जारी किए

NVIDIA ने Nemotron 3 Embed जारी किया है, जो उत्पादन-स्तर के RAG, एजेंटिक रीट्रीवल, कोड रीट्रीवल और एजेंट मेमोरी के लिए रीट्रीवल गुणवत्ता को बेहतर बनाने के लिए डिज़ाइन किए गए खुले और वाणिज्यिक रूप से उपलब्ध एम्बेडिंग मॉडल का एक संग्रह है। इस संग्रह में 8B का एक मॉडल शामिल है जो RTEB लीडरबोर्ड पर समग्र रूप से #1 स्थान पर है, इसके अलावा डेप्लॉयमेंट के लिए अनुकूलित कुशल 1B वेरिएंट भी हैं।

arxiv arXiv cs.CL · 24 दिन पहले

RAGthoven बहुभाषी हास्य उत्पादन में Gemini 2.5 Flash के साथ बराबर होने के लिए मल्टी-स्टेज RAG पाइपलाइन का उपयोग करता है

लेखकों ने SemEval-2026 Task 1 के लिए एक सिस्टम, RAGthoven प्रस्तुत किया जो कम्प्यूटेशनल हास्य सिद्धांत पर आधारित मल्टी-स्टेज लार्ज लैंग्वेज मॉडल पाइपलाइन में क्रिएटिव टेक्स्ट जनरेशन को विघटित करता है। फाइनल कॉन्फ़िगरेशन एक चुने हुए जोक्स कॉर्पस से रेट्रीवल-एगमेंटेड जनरेशन के साथ Planner को बढ़ाता है और एजेंटिक वेरिएंट्स का मूल्यांकन एक नॉन-एजेंटिक बेलाइन के खिलाफ करता है।

arxiv arXiv cs.CL · 24 दिन पहले · 1 बार देखा गया

Apaf हाइब्रिड फ्रेमवर्क आपदा शासन नीतियों में वार्तालाप का विश्लेषण करता है

लेखकों ने Apaf प्रस्तुत किया, एक हाइब्रिड LLM-प्रतीकात्मक पाइपलाइन जो नीति पाठ पर मात्रात्मक द्विध्रुवीय तर्क फ्रेमवर्क के रूप में आलोचनात्मक वार्तालाप विश्लेषण को संचालित करती है। तर्कों को विचारशील या प्रबंधकीय फ्रेम में वर्गीकृत किया जाता है, और LLM-निकाले गए विशेषताओं पर निर्धारित नियमों द्वारा चार फ्रेम-मध्यस्थ संबंध उपप्रकार उत्पन्न किए जाते हैं।

arxiv arXiv cs.CL · 24 दिन पहले

सैद्धांतिक स्तर की स्वतः-प्रारूपीकरण: अलग-अलक कथनों से एकीकृत औपचारिक ज्ञान आधारों तक

यह स्थिति पत्र सैद्धांतिक स्तर की स्वतः-प्रारूपीकरण का समर्थन करता है, जिसमें व्यक्तिगत कथनों पर ध्यान देने के बजाय पूर्ण सिद्धांतों को संरचित पुस्तकालयों के रूप में प्रारूपीकृत करना शामिल है।

arxiv arXiv cs.CL · 24 दिन पहले · 1 बार देखा गया

कोरपस-अनुकूल फाइन-ट्यूनिंग SQL स्कीमा रिकॉल को बेहतर बनाता है

लेखकों ने पाँच टेक्स्ट-टू-SQL डेटासेट (Spider, BIRD, BEAVER और दो LiveSQLBench वेरिएंट्स) को स्कीमा लिंकिंग का मूल्यांकन करने के लिए टेबल और कॉलम रिकॉलिवेशन टास्क के रूप में पुनर्परिभाषित किया। उन्होंने 305M-पैरामीटर एम्बेडर के लिए कोरपस-अनुकूल फाइन-ट्यूनिंग प्रस्तावित की, जिससे औसत recall@10 को 60.4 से बढ़ाकर 75.6 किया गया।

arxiv arXiv cs.CL · 24 दिन पहले

LLM-as-a-judge संकेत बंद-लूप तालिका पहचान को अनुकूलित करने में विफल रहे

FinTabNet और OmniDocBench का उपयोग करने वाला एक अध्ययन दिखाता है कि LLM-as-a-judge संकेत तालिका पहचान में बंद-लूप पुनर्जनन को अनुकूलित करने के लिए अपर्याप्त हैं। शोध से पता चलता है कि जजों के स्कोर अक्सर टाई होते थे, रैंकिंग पुनरुत्पादक नहीं थीं, और सिस्टम पुनरावृत्ति द्वारा उत्पन्न बेहतर उम्मीदवारों को पुनर्प्राप्त करने में विफल रहा।

arxiv arXiv cs.CL · 24 दिन पहले

POS परत Irabu Ryukyuan के स्वचालित अंतररेखीय ग्लॉसिंग के लिए आवश्यक डेटा को आधा कर देती है

शोधकर्ताओं ने Irabu Ryukyuan के लिए एक तंत्रिका टिप्पणी पाइपलाइन लागू की ताकि इंटरलाइनराइज्ड टेक्स्ट का निर्माण स्वचालित किया जा सके, जिससे मैन्युअल दस्तावेज़ीकरण के उच्च खर्च को दूर किया गया। अध्ययन में लगभग एक घंटे की टिप्पणी किए गए डिस्कोर्स की कठोर सीमा के तहत छोटे BiLSTM-CRF मॉडल का उपयोग करके मोर्फेम सेगमेंटेशन, POS टैगिंग और ग्लॉसिंग का मूल्यांकन किया गया।