xAI выпустила Grok-3, новую большую языковую модель, которая заняла первое место в таблице лидеров Chatbot Arena с результатом 1402. Это достижение стало первым случаем, когда какая-либо модель преодолела порог в 1400 баллов на этой платформе.

  • Elon Musk описывает Grok-3 как модель, превосходящую своего предшественника, Grok-2, на порядок по уровню возможностей.
  • Модель обучалась на собственном ИИ-суперкомпьютере xAI, включающем полностью связанный кластер GPU H100, развернутый всего за 122 дня.
  • xAI представила Grok-3 Reasoning Beta и более компактную модель Grok-3 Mini Reasoning для улучшения адаптивных способностей к рассуждению.
  • Первоначальные тесты показывают, что большая версия Grok-3 превосходит мини-версию в бенчмарке AIME 2025 для старшеклассников.
  • Выпуск совпал с объявлением о создании студии ИИ-игр в xAI, продемонстрированной на примере генерации смеси из Tetris и Bejeweled.

Быстрый прогресс объясняется прорывами в архитектуре модели и эффективности обучения, что делает Grok-3 значимым конкурентом моделей от OpenAI и Google DeepMind.