A Anthropic está alterando o Claude Code para que o modo Auto se torne a configuração padrão para novas sessões nos planos Pro, Max e Team a partir de 14 de agosto. Essa mudança segue a adoção interna na Anthropic e novos dados de avaliação demonstrando segurança aprimorada contra injeção de prompts.
- Um estudo com 1.053 testadores pagos descobriu que enquanto apenas 13,6% dos humanos recusaram um comando perigoso, o modo Auto teria bloqueado 89% dessas ações.
- Uma avaliação independente pela Trajectory Labs testou 720 cenários de injeção indireta de prompts contra Claude Fable 5, Opus 5 e Sonnet 5 executando o modo Auto.
Nenhum dos 720 tentativas de ataque teve sucesso contra os modelos Claude especificados durante o teste de terceiros.
A mudança visa mitigar a fadiga de confirmação e reduzir riscos de injeção de prompts e exfiltração de dados, confiando em verificações de permissão automatizadas em vez de aprovação humana.