Anthropic은 Claude Opus 4.8을 대체하는 플래그십 Opus-tier 모델인 Claude Opus 5를 출시했으며, 입력 토큰당 백만 개당 $5, 출력 토큰당 백만 개당 $25로 기존과 동일한 가격을 유지하고 있습니다.
- 사고 기능이 기본적으로 활성화되었으며, effort 매개변수로 제어됩니다. xhigh 또는 max 노력 수준에서 사고 기능을 비활성화하면 400 오류가 반환되는 중단적 변경 사항이 포함되었습니다.
- 모델 ID는 claude-opus-5이며, 1M 토큰의 컨텍스트 창과 동기식 Messages API에서 최대 128k 토큰의 출력을 지원합니다.
- FrontierBench v0.1에서 Opus 5는 최대 노력 수준에서 43.3%의 점수를 기록하여 Fable 5 (33.7%)와 GPT-5.6 Sol (37.5%)를 앞섰습니다.
- 에이전트 성능이 크게 향상되어 OSWorld 2.0에서 70.57%, Zapier AutomationBench에서 26.0%를 달성했습니다.
- Opus 5는 ARC-AGI-3에서 검증된 30.16%의 점수를 기록했으며, 이는 이전 최고 점수의 약 네 배에 해당하며, 도구 없이 Humanity's Last Exam에서 56.3%의 점수를 받았습니다.
- 사이버 보안 장치가 조정되어 소스 코드 취약점 탐지는 허용되지만 악용은 차단되며, Gray Swan 벤치마크에서 프롬프트 인젝션 성공률이 크게 감소했습니다.
Anthropic은 Opus 5를 Claude Fable 5의 지능에 반값으로 접근하는 모델로 포지셔닝했으며, 이는 Claude Max의 기본 모델이자 Claude Pro에서 가장 강력한 옵션입니다.