Tencentは、1.8B、7B、30B-A3B (MoE) サイズを含む「高速推論」多言語翻訳モデルのHy-MT2ファミリーと、指示従順能力を評価するためのIFMTBenchベンチマークをリリースした。
- 本モデルは33言語間の翻訳をサポートし、複数の言語で指示を効果的に従順する。
- AngelSlim 1.25-bit極限量子化により、1.8Bモデルのストレージ要件が440 MBに削減され、推論速度が1.5倍向上した。
- 評価結果によると、7Bおよび30B-A3Bモデルは高速推論モードでDeepSeek-V4-ProやKimi K2.6などのオープンソースモデルを上回り、1.8BモデルはMicrosoftやDoubaoの主要商業APIを超えている。
- リリースには、フルパラメータファインチューニング、LoRA、DeepSpeed ZeRO構成をサポートする完全なトレーニングパイプラインが含まれる。
本モデルは現在HuggingFaceおよびModelScopeで利用可能であり、Tencentはコミュニティ参加を促進するためにWMT26と「動画字幕翻訳タスク」で提携している。