स्रोत · Tencent Hunyuan (HF)
lab Tencent Hunyuan (HF) · 16 दिन पहले · 42 बार देखा गया

टेंसेंट ने WeVisDoc-2B और WeVisDoc-4B दस्तावेज़ पार्सर जारी किए

टेंसेंट ने Qwen3-VL मॉडलों से फाइन-ट्यून किए गए पेज इमेज के लिए एक एंड-टू-एंड दस्तावेज़ पार्सर, WeVisDoc जारी किया है। सिस्टम पेज इमेज को संरचित Markdown में परिवर्तित करता है, जिसमें LaTeX सूत्र और HTML टेबल शामिल हैं।

lab Tencent Hunyuan (HF) · 16 दिन पहले · 82 बार देखा गया

Tencent ने WeVisDoc-4B जारी किया, एक एंड-टू-एंड दस्तावेज़ पार्सर

Tencent ने पेज इमेज के लिए एक एंड-टू-एंड दस्तावेज़ पार्सर WeVisDoc-4B जारी किया है जो पेजों को LaTeX सूत्रों और HTML तालिकाओं के साथ संरचित Markdown में परिवर्तित करता है। Qwen3-VL-4B-Instruct से फाइन-ट्यून किए गए, मॉडल ने OmniDocBench v1.6 पर 95.38 का समग्र स्कोर प्राप्त किया और सभी चार रिपोर्ट किए गए सेटिंग्स में तुलना किए गए पार्सर्स के बीच पहले स्थान पर है।

lab Tencent Hunyuan (HF) · 19 दिन पहले · 21 बार देखा गया

Tencent ने Qwen3 के लिए Simple Attention Sparsification चेकपॉइंट जारी किए

Tencent ने Simple Attention Sparsification (SAS) चेकपॉइंट जारी किए हैं जो Qwen3 मॉडल में प्रत्येक क्वेरी के लिए KV ब्लॉकों को रैंक करने और चुनने का सीखते हैं। घनी एटेंशन स्कोर को डिस्टिल करने वाले विधियों के विपरीत, SAS चयनित ब्लॉकों में निरंतर गेट्स जोड़ता है, जिससे भाषा-मॉडलिंग नुकसान के साथ संदर्भ रैंकिंग का एंड-टू-एंड अनुकूलन संभव होता है।

lab Tencent Hunyuan (HF) · 24 दिन पहले · 35 बार देखा गया

Tencent ने स्पीच जनरेशन और एडिटिंग के लिए ओपन-सोर्स AuK फाउंडेशन मॉडल जारी किया

Tencent ने स्पीच जनरेशन और एडिटिंग के लिए अपने AuK 1.5B फाउंडेशन मॉडल को कोड और मॉडल वेट्स सहित ओपन-सोफ्टवेयर के रूप में उपलब्ध कराया है।

lab Tencent Hunyuan (HF) · 24 दिन पहले · 32 बार देखा गया

टेंसेंट ने ओपन-सोर्स AuK-Flash जारी किया, जो 1.5B का एक संपीडित वॉइस जनरेशन मॉडल है

टेंसेंट ने स्पीच जनरेशन और एडिटिंग के लिए AuK फाउंडेशन मॉडल को ओपन सोर्स के रूप में उपलब्ध कराया है, जिसमें Hugging Face और ModelScope पर कोड और वेट्स शामिल हैं। रिलीज़ में AuK-Flash शामिल है, जो तेज़ इनफरेंस के लिए डिज़ाइन किया गया एक संपीडित (distilled) वेरिएंट है जिसमें केवल 4 स्टेप्स हैं।

lab Tencent Hunyuan (HF) · 26 दिन पहले · 41 बार देखा गया

Tencent ने गतिशील Prefix-MRL और प्रशिक्षण-मुक्त टोकन संपीड़न के साथ EVIE-4.5B जारी किया

Tencent ने EVIE-4.5B जारी किया है, जो एक उच्च-प्रदर्शन बहुभाषी दृश्य दस्तावेज़ पुनर्प्राप्ति मॉडल है जिसमें गतिशील Prefix-Multivector Retrieval Latency (Prefix-MRL) और प्रशिक्षण-मुक्त Hierarchical Agglomerative Clustering (HAC) टोकन संपीड़न शामिल हैं।

lab Tencent Hunyuan (HF) · 26 दिन पहले · 32 बार देखा गया

टेनेंट ने EVIE-8B जारी किया, एक 4096D दृश्य दस्तावेज़ पुनर्प्राप्ति मॉडल

टेनेंट ने EVIE-8B जारी किया है, जो उच्च क्षमता वाला एक दृश्य दस्तावेज़ पुनर्प्राप्ति मॉडल है जिसमें 4096-आयामी टोकन प्रतिनिधित्व और द्विदिक् पूर्ण ध्यान शामिल हैं। यह मॉडल हल्के EVIE-4.5B Prefix-MRL संस्करण के लिए शिक्षक आधार प्रदान करता है और दृश्य दस्तावेज़ पुनर्प्राप्ति मानचित्रों पर शीर्ष प्रदर्शन प्राप्त करता है।