xAI宣布推出Grok-1.5,这是一款具有增强推理能力且上下文窗口高达128,000个token的新模型。该模型将在未来几天内在𝕏平台上向早期测试人员和现有用户开放。

  • 在数学任务的MATH基准测试中达到50.6%,在GSM8K中达到90%。
  • 在代码生成的HumanEval基准测试中获得74.1%的分数。
  • 支持128K token的上下文长度,内存容量增加16倍。
  • 在“大海捞针”(Needle In A Haystack)评估中展示了完美的检索结果。
  • 基于使用JAX、Rust和Kubernetes构建的自定义分布式训练框架。

此次发布旨在为用户提供高级问题解决能力,并能够在保持指令遵循准确性的同时处理显著更长的文档。