Artificial Analysis a publié des résultats de benchmarks pour le modèle Qwen3.8-27B, comparant directement ses performances à celles de DeepSeek V4 et GPT-5.6 Luna Max.
L'analyse positionne Qwen3.8-27B comme étant équivalent en capacité à ces autres grands modèles de langage.