El Informe Técnico de Qwen3 presenta la última versión de la familia de modelos Qwen, con arquitecturas densas y de Mezcla de Expertos (MoE) con escalas de parámetros desde 0.6 hasta 235 mil millones. Una innovación clave es la integración del modo de pensamiento para razonamiento complejo y el modo sin pensamiento para respuestas rápidas en un marco unificado, eliminando la necesidad de cambiar entre diferentes modelos.
- Qwen3 introduce un mecanismo de presupuesto de pensamiento que permite a los usuarios asignar recursos computacionales de forma adaptativa durante la inferencia para equilibrar latencia y rendimiento.
- La serie de modelos alcanza resultados de vanguardia en diversas pruebas, incluyendo generación de código, razonamiento matemático y tareas de agentes.
- El soporte multilingüe se amplía de 29 a 119 idiomas y dialectos en comparación con su predecesor Qwen2.5.
- Todos los modelos Qwen3 son accesibles públicamente bajo la licencia Apache 2.0 para facilitar la reproducibilidad y la investigación impulsada por la comunidad.
Este enfoque unificado permite el cambio dinámico de modo basado en las consultas del usuario, mientras que la expansión del soporte lingüístico mejora la accesibilidad global a través de una mejor comprensión interlingual.