O modelo de linguagem grande proprietário da Alibaba Cloud, Qwen2.5-Max, alcançou a #7 posição geral no Chatbot Arena, equiparando-se a outros LLMs proprietários de topo com capacidades excepcionais em domínios técnicos.
- Ocupa a posição #1 nos benchmarks de matemática e codificação.
- O modelo ocupa a #2 posição em prompts difíceis, que envolvem tarefas complexas.
- Como um modelo Mixture of Experts (MoE), foi pré-treinado com mais de 20 trilhões de tokens e refinado via Fine-Tuning Supervisionado e Aprendizado por Reforço com Feedback Humano.
- Conseguiu as melhores pontuações nos principais benchmarks, incluindo MMLU-Pro, LiveCodeBench, LiveBench e Arena-Hard.
Os desenvolvedores podem acessar o Qwen2.5-Max através do Model Studio da Alibaba Cloud ou da plataforma Qwen Chat.