xAI 发布了 Grok 4.7,这是一款旨在提升困难编码任务和通用知识工作性能的新模型。它利用更大的基础模型和扩展的强化学习来更好地处理长上下文场景并验证其自身输出。

  • 在 CursorBench 4.0 上针对长时间运行的编码任务实现了前沿的价格性能比。
  • 在 GDPval 和 AA Briefcase 基准测试中优于 Grok 4.6,适用于专业工作流。
  • 在 LatchBio 的生物安全基准测试中以 62.4% 的成绩位居榜首,同时通过 HackerBench v0.3 仅允许 3.3% 的风险双重用途提示通过。
  • 价格从每百万输入 token $2 和每百万输出 token $6 起,并提供快速变体。

该模型现已在 Cursor、Grok Build、Grok API 和第三方平台上可用。