Tencent ने "तेज़-विचार करने वाले" बहुभाषी अनुवाद मॉडलों के Hy-MT2 परिवार को जारी किया है, जिसमें 1.8B, 7B, और 30B-A3B (MoE) आकार शामिल हैं, साथ ही निर्देश-अनुपालन क्षमताओं का मूल्यांकन करने के लिए IFMTBench बेंचमार्क भी।
- मॉडल 33 भाषाओं के बीच अनुवाद का समर्थन करते हैं और बहुभाषी निर्देशों को प्रभावी ढंग से पालन करते हैं।
- AngelSlim 1.25-bit अत्यधिक क्वांटीकरण 1.8B मॉडल की भंडारण आवश्यकता को 440 MB तक कम करता है और निष्पादन गति में 1.5x की वृद्धि करता है।
- मूल्यांकन दर्शाते हैं कि तेज़-विचार मोड में 7B और 30B-A3B मॉडल DeepSeek-V4-Pro और Kimi K2.6 जैसे ओपन-सोर्स मॉडल से बेहतर प्रदर्शन करते हैं, जबकि 1.8B मॉडल Microsoft और Doubao के मुख्यधारा व्यावसायिक API को पार कर जाता है।
- रिलीज में पूर्ण-पैरामीटर फाइन-ट्यूनिंग, LoRA, और DeepSpeed ZeRO कॉन्फ़िगरेशन का समर्थन करने वाला एक पूर्ण प्रशिक्षण पाइपलाइन शामिल है।
मॉडल अब HuggingFace और ModelScope पर उपलब्ध हैं, साथ ही Tencent ने सामुदायिक भागीदारी को बढ़ावा देने के लिए WMT26 के साथ "वीडियो सबटाइटल अनुवाद कार्य" के लिए साझेदारी की है।