Tencent a publié la famille de modèles de traduction multilingue « à réflexion rapide » Hy-MT2, incluant les tailles 1.8B, 7B et 30B-A3B (MoE), ainsi que le benchmark IFMTBench pour évaluer les capacités de suivi d'instructions.

  • Les modèles prennent en charge la traduction parmi 33 langues et suivent efficacement les instructions dans plusieurs langues.
  • La quantification extrême AngelSlim à 1,25 bits réduit l'exigence de stockage du modèle 1.8B à 440 Mo et améliore la vitesse d'inférence de 1,5x.
  • Les évaluations montrent que les modèles 7B et 30B-A3B surpassent les modèles open-source comme DeepSeek-V4-Pro et Kimi K2.6 en mode à réflexion rapide, tandis que le modèle 1.8B dépasse les API commerciales grand public de Microsoft et Doubao.
  • La publication inclut un pipeline d'entraînement complet prenant en charge l'affinage plein paramètre, LoRA et les configurations DeepSpeed ZeRO.

Les modèles sont désormais disponibles sur HuggingFace et ModelScope, Tencent s'associant à WMT26 pour la « Tâche de traduction de sous-titres vidéo » afin d'encourager la participation de la communauté.