SpaceXAI发布了Grok 4.6,这是对Grok 4.5的后期训练升级版本,具备50万token的上下文窗口,并增强了长程代理、编码和知识工作的能力。

  • 该模型在Artificial Analysis Intelligence Index上得分61,与GPT-5.6 Sol Max持平,并在GDPval-AA v2和AA-Briefcase基准测试中领先。
  • 引入了新的`xhigh`推理努力级别,支持文本和图片输入,仅输出文本。
  • SpaceXAI报告称,由于在代理环境中进行了补充训练和强化学习,模型在更长轨迹中的自我测试和验证行为有所改进。
  • 该模型可通过xAI API、Grok Build和Cursor获取,对于低于20万prompt token的输入,定价分别为每1M token $2/$0.50/$6。

此次发布面向软件工程、金融研究和法律分析领域,通过现有集成方式为种子阶段团队和中端市场工程组织提供即时采用能力。