Artificial Analysis telah menerbitkan hasil benchmark untuk model Qwen3.8-27B, membandingkan kinerjanya secara langsung dengan DeepSeek V4 dan GPT-5.6 Luna Max.

Analisis ini menempatkan Qwen3.8-27B sebagai setara dalam kemampuan dengan model bahasa besar lainnya ini.