A Artificial Analysis publicou resultados de benchmarks para o modelo Qwen3.8-27B, comparando diretamente seu desempenho com o DeepSeek V4 e o GPT-5.6 Luna Max.
A análise posiciona o Qwen3.8-27B como equivalente em capacidade a esses outros grandes modelos de linguagem.