Poolside发布了Laguna S 2.1,这是一个拥有118B参数的混合专家(Mixture-of-Experts)模型,专为智能体编码任务设计。该模型的权重在Hugging Face上以OpenMDW-1.1许可证发布,并可在单台NVIDIA DGX Spark上运行。

  • 它在思考和无需思考模式下均保持1M-token上下文窗口,每token仅激活8B参数。
  • 在SWE-Bench Multilingual上得分78.5%,位居公开披露规模的开源模型榜首。
  • 在启用最大思考能力的Terminal-Bench 2.1上达到70.2%的得分,优于多个更大的闭源系统。
  • 该模型在4,096台NVIDIA H200 GPU上用不到九周的时间训练完成,标志着Poolside在三个月内发布的第三款模型。

此次发布为长周期编码基准测试提供了一种高效的开源权重替代方案,与更大的专有模型相比,以更低的推理成本提供高性能。