Claude Opus 5.5가 출시되어 SimpleBench에서 88.4%의 점수로 선두를 차지했으며, 고품질 설명 영상을 생성하는 능력으로 커뮤니티의 큰 관심을 받고 있습니다.
- 비전 평가에서 Anthropic이 지금까지 개발한 최고의 비전 모델로 평가받았으며, Fable 5와 GPT-6 Sol을 능가하고 Fable 5.1보다 약 60% 저렴합니다.
- Terminal-Bench-Science의 추론 성능은 xhigh 노력 시 62%로 정점에 달하지만, 강제된 최소 예산으로 인해 최대 노력 시 59%로 하락합니다.
- GPT-6 Astra와 함께 Terminal-Bench-Science 리더보드에서 선두를 차지하며 Fable 5.1보다 약 20점 앞서 있습니다.
- $200 Claude Code 플랜이 Codex를 능가한다는 보고가 있으며, Astra는 검토 및 감사 작업에 선호되는 모델로 남아 있습니다.
이번 출시로 Opus 5.5는 경쟁사 대비 뛰어난 비전 능력과 비용 효율성을 갖춘 최상위 프론티어 모델로 자리매김했습니다.