Проприетарная большая языковая модель Alibaba Cloud Qwen2.5-Max достигла общего 7-го места в рейтинге Chatbot Arena, сопоставившись с другими ведущими проприетарными LLM благодаря исключительным возможностям в технических областях.

  • Она занимает 1-е место в тестах по математике и программированию.
  • Модель заняла 2-е место в сложных промптах, включающих сложные задачи.
  • Будучи моделью типа Mixture of Experts (MoE), она была предварительно обучена на более чем 20 триллионах токенов и доработана с помощью обучения с учителем (SFT) и обучения с подкреплением на основе отзывов людей (RLHF).
  • Она показала ведущие результаты в основных тестах, включая MMLU-Pro, LiveCodeBench, LiveBench и Arena-Hard.

Разработчики могут получить доступ к Qwen2.5-Max через Model Studio от Alibaba Cloud или платформу Qwen Chat.