xAI a publié Grok-3, un nouveau grand modèle de langage qui a décroché la première place du classement Chatbot Arena avec un score de 1402. Cette réalisation marque la première fois qu'un modèle dépasse le seuil des 1400 sur la plateforme.
- Grok-3 est décrit par Elon Musk comme étant d'un ordre de grandeur plus capable que son prédécesseur, Grok-2.
- Le modèle a été entraîné sur un supercalculateur IA personnalisé doté d'un cluster de GPU H100 entièrement connecté, déployé en seulement 122 jours.
- xAI a introduit Grok-3 Reasoning Beta et un modèle Grok-3 Mini Reasoning plus petit pour améliorer les capacités de raisonnement adaptatif.
- Les tests initiaux montrent que le modèle Grok-3 plus grand surpasse la version mini sur le benchmark AIME 2025 destiné aux lycéens.
- Le lancement coïncide avec l'annonce d'un studio de jeux vidéo IA chez xAI, démontré par la génération d'un mélange de Tetris et Bejeweled.
L'avancement rapide est attribué à des percées dans l'architecture des modèles et l'efficacité de l'entraînement, positionnant Grok-3 comme un concurrent majeur des modèles d'OpenAI et Google DeepMind.