Le modèle de langage large propriétaire d'Alibaba Cloud, Qwen2.5-Max, a atteint la #7 position globale sur Chatbot Arena, égalant d'autres LLM propriétaires de premier plan grâce à des capacités exceptionnelles dans les domaines techniques.

  • Il occupe la position #1 dans les benchmarks de mathématiques et de codage.
  • Le modèle se classe #2 dans les prompts difficiles, qui impliquent des tâches complexes.
  • En tant que modèle Mixture of Experts (MoE), il a été pré-entraîné sur plus de 20 billions de tokens et affiné via le Fine-Tuning Supervisé et l'Apprentissage par Renforcement avec Retour d'Expérience Humain.
  • Il a obtenu les meilleurs scores dans les principaux benchmarks, notamment MMLU-Pro, LiveCodeBench, LiveBench et Arena-Hard.

Les développeurs peuvent accéder à Qwen2.5-Max via le Model Studio d'Alibaba Cloud ou la plateforme Qwen Chat.