알리바바 클라우드의 독점 대형 언어 모델인 Qwen2.5-Max는 기술 분야에서 뛰어난 능력을 갖춘 다른 주요 독점 LLM들과 어깨를 나란히 하며 Chatbot Arena 전체 순위에서 7위를 기록했습니다.

  • 수학 및 코딩 벤치마크에서 1위를 차지했습니다.
  • 복잡한 작업을 포함하는 하드 프롬프트에서 2위에 랭크되었습니다.
  • Mixture of Experts (MoE) 모델로서, 이 모델은 20조 개 이상의 토큰으로 사전 학습되었으며, Supervised Fine-Tuning과 Reinforcement Learning from Human Feedback를 통해 정제되었습니다.
  • MMLU-Pro, LiveCodeBench, LiveBench, Arena-Hard 등 주요 벤치마크에서 선도적인 점수를 획득했습니다.

개발자는 알리바바 클라우드의 Model Studio 또는 Qwen Chat 플랫폼을 통해 Qwen2.5-Max에 접근할 수 있습니다.