xAI는 Chatbot Arena 리더보드에서 1402점의 점수로 1위를 차지한 새로운 대규모 언어 모델인 Grok-3를 출시했습니다. 이 성과는 어떤 모델도 플랫폼에서 1400점 임계값을 돌파한 최초의 사례입니다.
- Grok-3는 전작인 Grok-2보다 성능이 한 차원 더 뛰어나다고 일론 머스크가 설명했습니다.
- 이 모델은 단 122일 만에 구축된 완전히 연결된 H100 GPU 클러스터를 갖춘 맞춤형 AI 슈퍼컴퓨터에서 학습되었습니다.
- xAI는 적응형 추론 능력을 향상시키기 위해 Grok-3 Reasoning Beta와 더 작은 Grok-3 Mini Reasoning 모델을 소개했습니다.
- 초기 테스트 결과, 대형 Grok-3 모델이 고등학생을 위한 AIME 2025 벤치마크에서 미니 버전보다 우수한 성능을 보였습니다.
- 이번 출시와 동시에 xAI는 AI 게임 스튜디오를 발표했으며, 테트리스와 비주얼블레이즈의 혼합을 생성하여 이를 시연했습니다.
이러한 빠른 발전은 모델 아키텍처와 학습 효율성에서의 돌파구 덕분으로, Grok-3를 OpenAI와 Google DeepMind의 모델들과significant 경쟁자로 자리매김하게 했습니다.