阿里巴巴的Qwen团队已通过API广泛提供Qwen3.8-Max,并计划在下周开放Qwen3.8-Max和较小的Qwen3.8-27B检查点的开源权重。旗舰模型采用2.4万亿参数的混合专家架构,支持文本、图像和视频输入。

  • Qwen3.8-Max具备1M token的上下文窗口,最大输入为991K tokens,输出为131K tokens。
  • 定价为每1M输入tokens 2.00美元,每1M输出tokens 6.00美元,缓存读取输入为0.25美元。
  • 该模型在Terminal-Bench 2.1中得分86.6,并在PaperBench中以93.0领先,显示出在多模态和智能体任务方面相比前代模型的显著提升。
  • 支持的功能包括函数调用、结构化输出以及五种内置工具,如code_interpreter和web_search。

此次发布为软件工程和法律审查等行业提供了高度强大的多模态选项,尽管2.4T的参数数量限制了本地部署仅能使用较小的Qwen3.8-27B变体。