IBM 发布具备原生推理能力的 Granite 4.2 和 Granite Speech 5.0 Turbo
IBM 发布了更新后的 Granite 4.2 语言模型,参数规模分别为 3B、8B 和 30B,专为具有原生逐步推理能力的企业智能体工作流而设计。除了语言模型外,IBM 还推出了 Granite Speech 5.0 Turbo CTC,这是一种轻量级语音模型,针对边缘设备上的高吞吐量转录进行了优化。
IBM 发布了更新后的 Granite 4.2 语言模型,参数规模分别为 3B、8B 和 30B,专为具有原生逐步推理能力的企业智能体工作流而设计。除了语言模型外,IBM 还推出了 Granite Speech 5.0 Turbo CTC,这是一种轻量级语音模型,针对边缘设备上的高吞吐量转录进行了优化。
IBM发布了Granite 4.2,这是一个包含3B、8B和30B规模的密集解码器推理大型语言模型系列。这些模型从零开始使用约15万亿个token进行预训练,上下文窗口扩展至512K token。
IBM和Confluent已将IBM的Granite时间序列基础模型(TSFM)集成到Confluent Cloud中,从而在Apache Flink内部直接实现实时预测和异常检测。
IBM已发布Granite 4.2,这是一系列开源推理语言模型,包含3B、8B和30B参数规模,其核心在于显式的思维链能力,而非简单的指令遵循。这些模型为仅解码器的密集Transformer架构,在约15万亿个token上进行预训练,并通过多阶段强化学习链进行后训练,其中较大变体采用了代理式强化学习。
IBM发布了Granite Speech 5.0 Turbo CTC模型,这是一种专为转录任务设计的语音转文本解决方案。
IBM发布了Granite 4.2开源推理模型系列,包括旗舰版30B、中型8B和紧凑型3B变体。这些模型利用原生思维链能力,提升在数学、编码和复杂多步问题上的表现。
IBM发布了Granite Speech系列中的两款新型紧凑型470M参数英语语音识别模型:`granite-speech-5.0-470m-turboctc`和`granite-speech-5.0-470m-turboctc-nc`。这些仅编码器模型在NVIDIA H200 GPU上实现了前所未有的超过12,600 RTFx的转录速度,同时保持高精度。
llama.cpp 项目发布了版本 b10514,引入了 IBM's GraniteSWAForCausalLM 和 GraniteMoeSWAForCausalLM 架构的转换基础设施。此更新使用户能够将这两种特定模型类型转换为 GGUF 格式,以便与 llama.cpp 一起使用。
IBM Research 与包括布鲁克海文国家实验室和魁北克水电公司在内的合作伙伴一起,发布了 GENCO,这是一个用于稳态电网分析的开源几何神经校正求解器。此次发布是 Linux Foundation Energy (LF Energy) 托管的 OpenGridFM 项目的一部分,并包含 GridFM 开发框架,以促进构建和基准测试神经电网求解器。