xAI가 이전 Grok-1.5 모델보다 상당한 업그레이드를 의미하는 Grok-2와 그 소형 변형인 Grok-2 mini의 초기 미리 보기를 출시했습니다. 이 새로운 모델들은 현재 Premium 및 Premium+ 사용자를 위해 𝕏에서 베타로 이용 가능하며, 기업용 API 접근은 이번 달 후반에 계획되어 있습니다.
- Grok-2는 채팅, 코딩, 추론 분야에서 최전선의 능력을 보여주며 LMSYS Chatbot Arena 리더보드에서 Claude 3.5 Sonnet과 GPT-4-Turbo를 능가합니다.
- 두 모델 모두 지시 따르기, 사실적 정보 제공, 도구 사용 측면에서 Grok-1.5 대비 상당한 개선을 보여줍니다.
- 벤치마크는 대학원 수준의 과학(GPQA), 일반 지식(MMLU, MMLU-Pro), 수학(MATH) 분야에서 다른 최전선 모델들과 경쟁력 있는 성능을 나타냅니다.
- Grok-2는 시각적 수학 추론(MathVista)과 문서 기반 질문 답변(DocVQA)에서 최고 수준의 결과를 달성했습니다.
- 기업용 API는 필수 다중 요소 인증과 같은 향상된 보안 기능과 함께 다중 지역 추론 배포를 지원합니다.
이번 출시로 xAI는 새로운 컴퓨팅 클러스터와 확장된 멀티모달 이해를 통해 핵심 추론 능력을 발전시켜 AI 개발의 최전선에 서게 되었습니다.