O Relatório Técnico do Qwen3 apresenta a versão mais recente da família de modelos Qwen, com arquiteturas densas e Mixture-of-Expert (MoE) e escalas de parâmetros de 0,6 a 235 bilhões. Uma inovação chave é a integração do modo de raciocínio para raciocínio complexo e do modo sem raciocínio para respostas rápidas em um framework unificado, eliminando a necessidade de alternar entre diferentes modelos.

  • O Qwen3 introduz um mecanismo de orçamento de raciocínio que permite aos usuários alocar recursos computacionais de forma adaptativa durante a inferência para equilibrar latência e desempenho.
  • A série de modelos alcança resultados de ponta em diversos benchmarks, incluindo geração de código, raciocínio matemático e tarefas de agente.
  • O suporte multilíngue é expandido de 29 para 119 idiomas e dialetos em comparação com seu antecessor Qwen2.5.
  • Todos os modelos Qwen3 estão acessíveis publicamente sob a licença Apache 2.0 para facilitar a reprodutibilidade e a pesquisa impulsionada pela comunidade.

Essa abordagem unificada permite a alternância dinâmica de modo com base nas consultas do usuário, enquanto o suporte expandido a idiomas melhora a acessibilidade global por meio de uma melhor compreensão interlingual.