El equipo de Qwen ha publicado el informe técnico de Qwen2, presentando una nueva serie de modelos de lenguaje grandes que van desde 0.5 hasta 72 mil millones de parámetros, incluyendo tanto arquitecturas densas como Mixture-of-Experts (MoE).
- El modelo base insignia Qwen2-72B obtiene puntuaciones de 84.2 en MMLU, 89.5 en GSM8K y 64.6 en HumanEval.
- La variante Qwen2-72B-Instruct ajustada con instrucciones alcanza 9.1 en MT-Bench y 35.7 en LiveCodeBench.
- Los modelos se entrenaron con más de 7 billones de tokens y soportan aproximadamente 30 idiomas.
- Los pesos están disponibles abiertamente en Hugging Face y ModelScope para uso de la comunidad.
El lanzamiento tiene como objetivo proporcionar modelos fundamentales de alto rendimiento que compitan con sistemas propietarios, manteniéndose accesibles para investigación y despliegue.