Anthropic은 8월 14일부터 Pro, Max 및 Team 플랜의 새 세션에 대해 Auto 모드가 기본 설정이 되도록 Claude Code를 변경하고 있습니다. 이 변화는 Anthropic 내부 채택과 프롬프트 인젝션에 대한 향상된 보안을 보여주는 새로운 평가 데이터에 이어집니다.
- 1,053명의 유료 테스터에 대한 연구에서 위험한 명령을 거부한 인간은 단 13.6%였지만, Auto 모드는 그러한 작업의 89%를 차단했을 것입니다.
- Trajectory Labs의 독립 평가는 Auto 모드로 실행되는 Claude Fable 5, Opus 5 및 Sonnet 5에 대해 720개의 간접 프롬프트 인젝션 시나리오를 테스트했습니다.
제3자 테스트 동안 지정된 Claude 모델에 대한 720회의 공격 시도 중 성공한 것은 없었습니다.
이 변화는 확인 피로를 완화하고 프롬프트 인젝션 및 데이터 유출의 위험을 줄이기 위해 인간의 승인 대신 자동화된 권한 확인에 의존하는 것을 목표로 합니다.