Anthropic은 추론, 코딩, 시각적 처리 분야의 능력을 향상시킨 Claude 3.5 Haiku와 업그레이드된 Claude 3.5 Sonnet 버전을 출시했습니다. 업그레이드된 Sonnet 모델의 가장 중요한 추가 기능은 GUI 스크린샷을 해석하고 작업을 자율적으로 수행하기 위해 도구 호출을 생성할 수 있는 능력입니다.
- 업그레이드된 Claude 3.5 Sonnet은 스크린샷 입력만 사용하여 OSWorld 벤치마크에서 14.9%의 최상위 평균 성공률을 달성했으며, 상호작용 단계를 늘리면 22%로 상승합니다.
- 새로운 Claude 3.5 Haiku 모델은 추론 및 지시 따르기 분야에서 강력한 성능을 보여주며, 종종 원래의 Claude 3.5 Sonnet과 Claude 3 Opus와 비교할 만합니다.
- 두 모델 모두 컴퓨터 사용 관련 위험에 대한 다중모드 레드팀링을 포함한 광범위한 안전 평가와 미국 및 영국 AI 안전 연구소의 공동 사전 배포 테스트를 거쳤습니다.
- 업그레이드된 Claude 3.5 Sonnet의 지식 컷오프는 2024년 4월이며, Claude 3.5 Haiku는 2024년 7월에 컷오프됩니다.
이러한 업데이트는 Anthropic의 책임 있는 확장 정책과 일치하는 엄격한 안전 기준을 유지하면서 컴퓨터 사용 및 개선된 에이전트 작업 완료를 통해 사용자에게 향상된 자동화 기능을 제공합니다.