구글 딥마인드는 코딩, 기업 지식 작업 및 사이버 방어를 위해 설계된 새로운 대규모 언어 모델인 제미니 4 아르곤을 선보였습니다. 이 모델은 현재 정부 사용자 및 신뢰할 수 있는 방어자를 위한 페어윈드 프로그램을 통해 제한적인 사이버 보안 미리보기 버전으로 제공됩니다.
- 제미니 4 아르곤은 긴 응답을 일시 중단하고 재개하는 새로운 "Long Decode Continuation" API를 통해 달성된 업계 최고 수준의 1M 토큰 출력 제한 기능을 갖추고 있습니다.
- 구글은 이 모델이 신뢰할 수 있는 19개 벤치마크 중 13개에서 최상위 결과를 달성했으며, DeepSWE와 같은 지표에서 GPT-6 Astra 및 Claude Opus 5.5를 능가한다고 주장합니다.
- 표준 가격은 1M 입력/출력 토큰당 각각 $4/$20으로 책정되었으며, 50%의 introductory 할인 혜택이 제공됩니다.
- Artificial Analysis와 Vals의 독립적인 평가 결과는 엇갈렸으며, 아르곤은 코딩 및 보안 작업에서 높은 순위를 보였지만 Astra와 같은 경쟁사 대비 낮은 정확도와 더 높은 환각 발생률을 보였습니다.
이 모델은 오픈AI와 앤트로픽의 최근 프론티어 모델에 대한 구글의 대응으로, AI 분야에서 리더십을 재확립하는 것을 목표로 합니다.