IBM已发布Granite 4.2,这是一系列开源推理语言模型,包含3B、8B和30B参数规模,其核心在于显式的思维链能力,而非简单的指令遵循。这些模型为仅解码器的密集Transformer架构,在约15万亿个token上进行预训练,并通过多阶段强化学习链进行后训练,其中较大变体采用了代理式强化学习。
- Granite 4.2提供了思考/非思考切换开关和低开销模式,8B和30B模型使用代理式强化学习进行训练,以在沙盒环境中编辑代码、操作终端并执行网络搜索。
- 30B模型在SWE-Bench Verified上取得57.00分,在Terminal-Bench 2.1上取得29.24分,整个系列采用Apache 2.0许可证用于商业用途。
- IBM还发布了Granite Speech 5.0 Turbo CTC,这是一个拥有4.7亿参数的模型,采用连接时序分类技术,在单块H200上报告的RTFx吞吐量接近12,600。
此次发布为企业提供了可部署的开放权重模型,具备复杂推理和代理任务能力,同时为受监管行业提供高吞吐量的语音转录工具。