Anthropic은 코딩, 고급 추론, AI 에이전트 워크플로우를 위한 새로운 벤치마크를 확립한 차세대 Claude 모델인 Claude Opus 4와 Claude Sonnet 4를 출시했습니다. 이 하이브리드 모델은 거의 즉각적인 응답과 더 깊은 추론을 위한 "확장된 사고" 모드를 제공하며, 병렬 도구 실행 및 개선된 메모리와 같은 새로운 기능도 지원합니다.

  • Claude Opus 4는 SWE-bench (72.5%)와 Terminal-bench (43.2%)에서 선두를 차지하며, 수 시간 동안 장기 실행 작업에 대한 성능을 유지합니다.
  • Claude Sonnet 4는 SWE-bench에서 최첨단인 72.7%의 점수를 달성하여, Sonnet 3.7의 업그레이드로서 능력과 효율성의 최적 조합을 제공합니다.
  • 두 모델 모두 베타 단계에서 도구 사용과 함께 확장된 사고를 지원하며, 웹 검색과 같은 추론과 동작을 교차할 수 있습니다.
  • Claude Code는 이제 VS Code 및 JetBrains에 대한 네이티브 통합과 커스텀 에이전트 구축을 위한 새로운 SDK를 포함하여 일반적으로 사용 가능합니다.
  • 새로운 API 기능에는 코드 실행 도구, MCP 연결자, Files API, 최대 1시간까지의 프롬프트 캐싱이 포함됩니다.

이 모델들은 코딩과 연구에서 한계를 넓히고 향상된 조향 가능성과 단축 행동 감소를 통해 일상적인 사용 사례에 최전선 성능을 제공함으로써 AI 전략을 발전시키기 위해 설계되었습니다.