Anthropic은 코딩 및 지식 작업용 새로운 플래그십 모델로 Claude Fable 5.1과 Claude Mythos 5.1을 출시했으며, 이를 자율적 다단계 작업에 대한 세계 최고 수준의 모델로 포지셔닝했습니다.

  • 이 모델들은 Terminal-Bench-Science(52.6%)와 HLE(59.1%)를 포함한 벤치마크에서 새로운 최첨도 기록을 달성했으며, Artificial Analysis Intelligence Index 점수는 66점입니다.
  • Anthropic은 엔터프라이즈 도입을 촉진하기 위해 에이전트 관측 가능성과 영데이터 유지 지원을 위한 Enterprise Frontier Safeguards(EFS)를 소개했습니다.
  • 입력 및 출력 가격은 변동이 없으나, 캐시 읽기 가격은 토큰 백만 개당 $0.25로 75% 인하되었습니다.
  • 초기 분석에 따르면 Fable와 Mythos 5.1은 서로 다른 안전 또는 라우팅 동작을 가진 동일한 기본 가중치를 공유할 가능성이 있으며, 별개의 기본 모델은 아닐 수 있습니다.

이번 출시의 목적은 속도, 문장 길이 및 어조를 개선하여 이전의 비현실성에 대한 비판을 해소하고, 장기적 문제 해결을 위한 신뢰할 수 있는 자율 에이전트가 필요한 사용자를 타겟팅하는 것입니다.