Artificial Analysis ha publicado resultados de benchmarks para el modelo Qwen3.8-27B, comparando directamente su rendimiento con DeepSeek V4 y GPT-5.6 Luna Max.

El análisis posiciona a Qwen3.8-27B como equiparable en capacidad a estos otros grandes modelos de lenguaje.