阿里巴巴的Qwen团队宣布了Qwen 3.8 Max,这是一款专注于编码、长周期智能体工作和多模态推理的新旗舰模型,拥有2.4T参数。该公司确认,Qwen 3.8 Max以及较小的Qwen 3.8-27B的开放权重版本将于下周发布。
- 该模型具备1M-token上下文窗口,每个token有95B个激活参数(约4%的激活率),并在其执行循环中提供原生视觉反馈。
- 阿里巴巴声称其能力包括超过10天的自主编码、500多次芯片设计优化迭代以及365天的电商策略执行。
- 独立评估显示,Qwen 3.8 Max在Frontend Code Arena中总体排名第4,得分为1,668 Elo;在Vision Arena中排名第2,得分为1,305分。
- 在Vals Index上,它在开放权重模型中排名第2,得分为66.1,与Claude Opus 4.7持平,但每次测试成本更低($2.68对比$6.17)。
- API定价为每百万输入token $2.00,每百万输出token $6.00。
这一公告表明,中国开放权重前沿模型现在正直接与顶级西方封闭模型竞争,特别是在编码和智能体工作流方面。