Motif-Technologies已正式发布其Motif-3大语言模型,作为韩国AI基础模型项目(독파모)的一部分。该314B参数量的混合专家模型在该项目第二轮中与竞争对手Upstage、LG AI Research和SKT展开竞争。

  • 架构:总计314B参数,每个token激活13B参数(314B-A13B)。
  • 智能体基准测试:得分包括GDPVal v2上的38.7、τ²-Bench Telecom上的94.7以及ITBench上的51.5。
  • 编码基准测试:在SWE-Bench Verified上取得76.2分,在Terminal-Bench 2.1上取得74.9分。
  • 推理与知识:在GPQA Diamond上录得83.4分,在IMOAnswerBench上录得83.2分,在Apex-Shortlist上录得75.5分。
  • 长上下文:在IFBench上获得78.2分,在AA-LCR上获得72.3分。

此次发布使Motif能够直接参与国家项目评估轮次中与其他主要韩国基础模型的竞争。