Artificial Analysis 对 Qwen 3.8 Low 和 Medium 模型进行了基准测试,报告了强劲的性能得分。

  • 结果表明,这些模型早期的成功并非仅仅归因于过度思考。
  • 高分表明 Qwen 3.8 架构中的优化非常有效。