Qwen 3.8 27B 模型通过 vLLM 以 FP8 格式运行,上下文窗口为 256K,在 Aider 基准测试中取得了 72.9 的分数。
- 该分数与 Gemini 2.5 Pro(72.9)持平,并超过了 Claude Opus 4(72.0)和 DeepSeek R1(71.4)。
- 作者指出,尽管该基准测试可能已过时,但该模型在 MacBook 上的性能可与一年多前的 state-of-the-art 模型相媲美。
- 实际性能被描述为由于测试框架的改进而超越了这些模型。
Qwen 3.8 27B 模型通过 vLLM 以 FP8 格式运行,上下文窗口为 256K,在 Aider 基准测试中取得了 72.9 的分数。