Проприетарная большая языковая модель Alibaba Cloud Qwen2.5-Max достигла общего 7-го места в рейтинге Chatbot Arena, сопоставившись с другими ведущими проприетарными LLM благодаря исключительным возможностям в технических областях.
- Она занимает 1-е место в тестах по математике и программированию.
- Модель заняла 2-е место в сложных промптах, включающих сложные задачи.
- Будучи моделью типа Mixture of Experts (MoE), она была предварительно обучена на более чем 20 триллионах токенов и доработана с помощью обучения с учителем (SFT) и обучения с подкреплением на основе отзывов людей (RLHF).
- Она показала ведущие результаты в основных тестах, включая MMLU-Pro, LiveCodeBench, LiveBench и Arena-Hard.
Разработчики могут получить доступ к Qwen2.5-Max через Model Studio от Alibaba Cloud или платформу Qwen Chat.