xAI发布了Grok-3,这是一款新的大型语言模型,以1402分的成绩登顶Chatbot Arena排行榜第一名。这一成就标志着该平台历史上首次有模型突破1400分的门槛。

  • Elon Musk将Grok-3描述为比其前身Grok-2能力强出一个数量级。
  • 该模型在一台定制构建的AI超级计算机上训练完成,该计算机配备了完全连接的H100 GPU集群,仅用时122天即部署完毕。
  • xAI推出了Grok-3 Reasoning Beta以及较小的Grok-3 Mini Reasoning模型,以增强自适应推理能力。
  • 初步测试显示,在面向高中生的AIME 2025基准测试中,较大的Grok-3模型表现优于迷你版。
  • 此次发布恰逢xAI宣布成立AI游戏工作室,并通过生成Tetris和Bejeweled的混合玩法进行了演示。

这一快速进步归因于模型架构和训练效率方面的突破,使Grok-3成为OpenAI和Google DeepMind旗下模型的有力竞争者。