智谱AI发布了GLM-4.5系列开源权重大语言模型,旨在精通工具使用和编码,并提供可切换的推理能力。
- GLM-4.5模型包含3550亿总参数和320亿激活参数,而较小的GLM-4.5-Air拥有1060亿总参数和120亿激活参数。
- 在至少一项推理、编码或智能体基准测试中,这两个模型均优于Anthropic Claude 4 Opus、DeepSeek-R1-0528、Google Gemini 2.5 Pro、Grok 4、Kimi K2和OpenAI o3。
- GLM-4.5在工具使用基准测试中达到90.6%的准确率,超越了Claude Sonnet 4和Kimi K2,并在MATH 500上与Claude 4 Opus持平,准确率达到98.2%。
- 权重可通过HuggingFace和ModelScope获取,采用MIT许可证,允许商业和非商业用途。
智谱AI的方法将基础模型的三种专用变体蒸馏到单一架构中,为针对智能体行为优化的开源权重模型建立了势头。