xAI a publié Grok-3, un nouveau grand modèle de langage qui a décroché la première place du classement Chatbot Arena avec un score de 1402. Cette réalisation marque la première fois qu'un modèle dépasse le seuil des 1400 sur la plateforme.

  • Grok-3 est décrit par Elon Musk comme étant d'un ordre de grandeur plus capable que son prédécesseur, Grok-2.
  • Le modèle a été entraîné sur un supercalculateur IA personnalisé doté d'un cluster de GPU H100 entièrement connecté, déployé en seulement 122 jours.
  • xAI a introduit Grok-3 Reasoning Beta et un modèle Grok-3 Mini Reasoning plus petit pour améliorer les capacités de raisonnement adaptatif.
  • Les tests initiaux montrent que le modèle Grok-3 plus grand surpasse la version mini sur le benchmark AIME 2025 destiné aux lycéens.
  • Le lancement coïncide avec l'annonce d'un studio de jeux vidéo IA chez xAI, démontré par la génération d'un mélange de Tetris et Bejeweled.

L'avancement rapide est attribué à des percées dans l'architecture des modèles et l'efficacité de l'entraînement, positionnant Grok-3 comme un concurrent majeur des modèles d'OpenAI et Google DeepMind.