Claude Opus 5는 전반적으로 Claude Opus 4.8보다 훨씬 강력하며, 에이전트 코딩, 컴퓨터 사용, 장기 지식 작업에서 가장 큰 향상을 보였습니다. 여러 서드파티 벤치마크에서 새로운 최첨단 기록을 수립했으며, 많은 평가에서 Claude Fable 5와 Claude Mythos 5에 필적하거나 앞서는 성능을 보입니다.

  • Opus 5는 실제 작업에서 Fable 5와 동등하거나 더 우수하면서도 속도는 빠르고 비용은 절반으로 책정되었습니다.
  • 이 모델은 사이버 관련 작업을 학습하는 것을 의도적으로 피했으므로, Mythos 클래스 모델에 있는 복잡한 사이버 공격의 전체 능력을 갖추지 못했습니다.
  • 바이러스학 평가에서 Opus 5는 Mythos 5보다 약간 더 나은 것으로 나타났는데, 이는 이러한 작업이 대규모 추론을 요구하기보다 개별 단계를 포함하기 때문입니다.
  • ArtificialAnalysis는 Opus 5를 새로운 최고치인 61로 평가했으며, Anthropic ECI 점 추정치는 162.1로 Mythos 추세선 위에 위치합니다.

해당 기사는 Opus 크기를 유지하고 사이버 학습을 피함으로써 방어자들이 Fable보다 85% 적게 트리거되는 분류기가 탑재된 더 우수한 도구에 접근할 시간을 확보할 수 있다고 제안합니다.