A equipe Qwen publicou o relatório técnico do Qwen2, apresentando uma nova série de grandes modelos de linguagem com parâmetros variando de 0,5 a 72 bilhões, incluindo tanto arquiteturas densas quanto Mixture-of-Experts (MoE).

  • O modelo base insignia Qwen2-72B alcança pontuações de 84,2 no MMLU, 89,5 no GSM8K e 64,6 no HumanEval.
  • A variante Qwen2-72B-Instruct ajustada por instruções atinge 9,1 no MT-Bench e 35,7 no LiveCodeBench.
  • Os modelos foram treinados com mais de 7 trilhões de tokens e suportam aproximadamente 30 idiomas.
  • Os pesos estão abertamente disponíveis no Hugging Face e ModelScope para uso da comunidade.

O lançamento visa fornecer modelos fundamentais de alto desempenho que competem com sistemas proprietários, permanecendo acessíveis para pesquisa e implantação.