Anthropic은 장기 실행 에이전트를 구동하고 코딩 및 전문 작업에서 상당한 개선을 제공하도록 설계된 새로운 모델인 Claude Opus 5를 출시했습니다. 이는 Opus 계층에 대한 단계적 개선으로 위치지어지며, 비용의 절반으로 Claude Fable 5에 가까운 성능을 제공합니다.

  • Frontier-Bench v0.1에서 Opus 5는 모든 다른 모델을 능가하며 작업당 더 낮은 비용으로 Opus 4.8의 성능을 두 배 이상 뛰어넘습니다.
  • 최대 노력 시 CursorBench 3.2에서 Fable 수준의 성능에 근접하지만 작업당 비용은 절반입니다.
  • ARC-AGI 3에서 Opus 5의 점수는 다음으로 우수한 모델보다 세 배 높습니다.
  • 이 모델은 특히 유기 화학 및 단백질 관련 작업을 포함한 과학 연구 분야에서 눈에 띄는 개선을 보여줍니다.
  • 이제 Claude Max의 기본 모델이자 Claude Pro에서 가장 강력한 모델입니다.

Opus 5는 매일 사용하도록 설계되었으며, 이전 모델보다 더 효율적으로 작동하고 자신의 작업을 검증하며 성공할 때까지 신중하게 반복하는 데 뛰어납니다.