लैब · Tencent
arxiv arXiv cs.CL · 5 दिन पहले · 8 बार देखा गया

KuaFu अरब स्केल पर उपयोगकर्ता व्यवहार को समझ में संपीड़ित करता है

Tencent ने KuaFu पेश किया, एक एकीकृत व्यवहार-संपीड़न परत जो कच्चे उपयोगकर्ता इतिहास को संवादात्मक एजेंट्स और सिफारिशकर्ताओं के लिए संपीड़ित निरूपण में बदल देती है। सिस्टम प्रत्येक व्यवधान आइटम को 128-256 चौड़ाई के 2-4 टोकन में संपीड़ित करने के लिए दो-अक्ष प्रोजेक्टर का उपयोग करता है, एक अरब उपयोगकर्ताओं के लिए लंबी अनुक्रमों के प्रसंस्करण में बाधाओं को दूर करता है।

media r/LocalLLaMA · 15 दिन पहले · 25 बार देखा गया

$1.4B मूल्यांकन वाली Naive AI, ओपन-वेट LLM रिलीज़ की योजना

त्सिंगहुआ यूनिवर्सिटी के प्रोफेसर डैई जिफेंग द्वारा स्थापित Stealth स्टार्टअप Naive AI ने $400 मिलियन के कुल निधि चक्र पूरे किए हैं, जिससे इसका मूल्यांकन $1.4 बिलियन से अधिक हो गया है। कंपनी इसी महीने से भी पहले अपने पहले बड़े भाषा मॉडल (जिसका नाम भी Naive है) को ओपन-वेट रिलीज़ के रूप में लाने की तैयारी कर रही है।

lab Tencent Hunyuan (HF) · 16 दिन पहले · 42 बार देखा गया

टेंसेंट ने WeVisDoc-2B और WeVisDoc-4B दस्तावेज़ पार्सर जारी किए

टेंसेंट ने Qwen3-VL मॉडलों से फाइन-ट्यून किए गए पेज इमेज के लिए एक एंड-टू-एंड दस्तावेज़ पार्सर, WeVisDoc जारी किया है। सिस्टम पेज इमेज को संरचित Markdown में परिवर्तित करता है, जिसमें LaTeX सूत्र और HTML टेबल शामिल हैं।

lab Tencent Hunyuan (HF) · 16 दिन पहले · 82 बार देखा गया

Tencent ने WeVisDoc-4B जारी किया, एक एंड-टू-एंड दस्तावेज़ पार्सर

Tencent ने पेज इमेज के लिए एक एंड-टू-एंड दस्तावेज़ पार्सर WeVisDoc-4B जारी किया है जो पेजों को LaTeX सूत्रों और HTML तालिकाओं के साथ संरचित Markdown में परिवर्तित करता है। Qwen3-VL-4B-Instruct से फाइन-ट्यून किए गए, मॉडल ने OmniDocBench v1.6 पर 95.38 का समग्र स्कोर प्राप्त किया और सभी चार रिपोर्ट किए गए सेटिंग्स में तुलना किए गए पार्सर्स के बीच पहले स्थान पर है।

lab Tencent Hunyuan (HF) · 19 दिन पहले · 21 बार देखा गया

Tencent ने Qwen3 के लिए Simple Attention Sparsification चेकपॉइंट जारी किए

Tencent ने Simple Attention Sparsification (SAS) चेकपॉइंट जारी किए हैं जो Qwen3 मॉडल में प्रत्येक क्वेरी के लिए KV ब्लॉकों को रैंक करने और चुनने का सीखते हैं। घनी एटेंशन स्कोर को डिस्टिल करने वाले विधियों के विपरीत, SAS चयनित ब्लॉकों में निरंतर गेट्स जोड़ता है, जिससे भाषा-मॉडलिंग नुकसान के साथ संदर्भ रैंकिंग का एंड-टू-एंड अनुकूलन संभव होता है।

lab Tencent Hunyuan (HF) · 24 दिन पहले · 35 बार देखा गया

Tencent ने स्पीच जनरेशन और एडिटिंग के लिए ओपन-सोर्स AuK फाउंडेशन मॉडल जारी किया

Tencent ने स्पीच जनरेशन और एडिटिंग के लिए अपने AuK 1.5B फाउंडेशन मॉडल को कोड और मॉडल वेट्स सहित ओपन-सोफ्टवेयर के रूप में उपलब्ध कराया है।

lab Tencent Hunyuan (HF) · 24 दिन पहले · 32 बार देखा गया

टेंसेंट ने ओपन-सोर्स AuK-Flash जारी किया, जो 1.5B का एक संपीडित वॉइस जनरेशन मॉडल है

टेंसेंट ने स्पीच जनरेशन और एडिटिंग के लिए AuK फाउंडेशन मॉडल को ओपन सोर्स के रूप में उपलब्ध कराया है, जिसमें Hugging Face और ModelScope पर कोड और वेट्स शामिल हैं। रिलीज़ में AuK-Flash शामिल है, जो तेज़ इनफरेंस के लिए डिज़ाइन किया गया एक संपीडित (distilled) वेरिएंट है जिसमें केवल 4 स्टेप्स हैं।

lab Tencent Hunyuan (HF) · 26 दिन पहले · 41 बार देखा गया

Tencent ने गतिशील Prefix-MRL और प्रशिक्षण-मुक्त टोकन संपीड़न के साथ EVIE-4.5B जारी किया

Tencent ने EVIE-4.5B जारी किया है, जो एक उच्च-प्रदर्शन बहुभाषी दृश्य दस्तावेज़ पुनर्प्राप्ति मॉडल है जिसमें गतिशील Prefix-Multivector Retrieval Latency (Prefix-MRL) और प्रशिक्षण-मुक्त Hierarchical Agglomerative Clustering (HAC) टोकन संपीड़न शामिल हैं।

lab Tencent Hunyuan (HF) · 26 दिन पहले · 32 बार देखा गया

टेनेंट ने EVIE-8B जारी किया, एक 4096D दृश्य दस्तावेज़ पुनर्प्राप्ति मॉडल

टेनेंट ने EVIE-8B जारी किया है, जो उच्च क्षमता वाला एक दृश्य दस्तावेज़ पुनर्प्राप्ति मॉडल है जिसमें 4096-आयामी टोकन प्रतिनिधित्व और द्विदिक् पूर्ण ध्यान शामिल हैं। यह मॉडल हल्के EVIE-4.5B Prefix-MRL संस्करण के लिए शिक्षक आधार प्रदान करता है और दृश्य दस्तावेज़ पुनर्प्राप्ति मानचित्रों पर शीर्ष प्रदर्शन प्राप्त करता है।