Tencent выпустила семейство «быстро думающих» многоязычных моделей перевода Hy-MT2, включающее размеры 1.8B, 7B и 30B-A3B (MoE), а также бенчмарк IFMTBench для оценки способности следовать инструкциям.

  • Модели поддерживают перевод между 33 языками и эффективно следуют инструкциям на нескольких языках.
  • Экстремальное квантование AngelSlim 1.25-bit снижает требования к хранилищу модели 1.8B до 440 МБ и увеличивает скорость вывода в 1.5 раза.
  • Оценки показывают, что модели 7B и 30B-A3B превосходят открытые модели, такие как DeepSeek-V4-Pro и Kimi K2.6, в режиме быстрого мышления, тогда как модель 1.8B превосходит основные коммерческие API от Microsoft и Doubao.
  • В релиз включён полный конвейер обучения, поддерживающий тонкую настройку всех параметров, LoRA и конфигурации DeepSpeed ZeRO.

Модели теперь доступны на HuggingFace и ModelScope, при этом Tencent сотрудничает с WMT26 в рамках «Задачи перевода видеосубтитров», чтобы поощрить участие сообщества.