AWS Strands Agents 팀은 Python과 TypeScript용 Apache 2.0 라이선스로 제공되는 범용 에이전트 하네스인 Strands Harness를 출시했습니다. 이 도구는 Claude Code나 Codex와 같은 환경에서 에이전트를 프로토타이핑하는 것과 커스텀 루프로 배포하는 것 사이의 격차를 해소하도록 설계되었습니다.
- ALFWorld, GAIA, Terminal-Bench 2.1을 포함한 여섯 가지 벤치마크에서 경쟁 하네스 대비 토큰 비용이 28% 낮아졌으며, 유사한 정확도를 유지합니다.
- 1,500 토큰을 초과하는 도구 결과를 잘라내고, 컨텍스트 사용량이 85%에 도달하면 요약 기능을 트리거하며, 루프 내에서 복구를 처리하는 내장 컨텍스트 관리 규칙을 갖추고 있습니다.
- Terminal-Bench 2.1에서 Claude Fable 5를 사용한 벤치마크 결과, Strands Harness는 정확도 69.7로 $56.29의 비용이 들었으며, 이는 정확도 61.8에 $248.05가 든 Claude Code보다 훨씬 저렴하면서도 점수 면에서 더 우수한 성능을 보였습니다.
- 이 시스템은 Amazon Bedrock, Anthropic, OpenAI, Google, Ollama 또는 LiteLLM을 통해 최신 추론 모델에서 실행할 수 있으며, 셸, 파일 및 웹 도구를 기본으로 제공합니다.
이번 출시를 통해 개발자들은 성능을 희생하지 않고 효율적인 컨텍스트 처리를 통해 운영 비용을 절감할 수 있는 배포 가능한 범용 에이전트 프레임워크를 얻게 됩니다.