xAI ha lanzado Grok-3, un nuevo modelo de lenguaje grande que ha asegurado el puesto #1 en el ranking de Chatbot Arena con una puntuación de 1402. Este logro marca la primera vez que cualquier modelo supera el umbral de 1400 en la plataforma.
- Elon Musk describe a Grok-3 como un orden de magnitud más capaz que su predecesor, Grok-2.
- El modelo fue entrenado en una supercomputadora de IA construida a medida, con un clúster de GPU H100 completamente conectado desplegado en solo 122 días.
- xAI presentó Grok-3 Reasoning Beta y un modelo más pequeño llamado Grok-3 Mini Reasoning para mejorar las capacidades de razonamiento adaptativo.
- Las pruebas iniciales muestran que el modelo Grok-3 más grande supera a la versión mini en el benchmark AIME 2025 para estudiantes de secundaria.
- El lanzamiento coincide con el anuncio de un estudio de juegos de IA en xAI, demostrado mediante la generación de una mezcla de Tetris y Bejeweled.
El rápido avance se atribuye a avances en la arquitectura del modelo y la eficiencia del entrenamiento, posicionando a Grok-3 como un competidor significativo para los modelos de OpenAI y Google DeepMind.