Anthropic rend le mode automatique par défaut pour les nouvelles sessions de Claude Code pour les plans Pro, Max et Team à partir du 14 août. Ce changement reflète la confiance de l'entreprise dans la capacité de la fonctionnalité à atténuer les risques tels que l'injection de prompts et l'exfiltration de données plus efficacement que la révision humaine.
- Une étude contrôlée de 1 053 testeurs payants a révélé que le mode automatique aurait bloqué 89 % des actions nuisibles, contre seulement 13,6 % refusés par les humains.
- Une évaluation de Trajectory Labs a testé 720 scénarios d'injection indirecte de prompts contre Claude Fable 5, Opus 5 et Sonnet 5 exécutant le mode automatique.
Aucune des 720 tentatives d'attaque n'a réussi contre les modèles Claude spécifiés lors de l'évaluation tierce.
Anthropic considère ce changement comme important car la fatigue de confirmation conduit à des comportements non sécurisés chez les réviseurs humains, tandis que le mode automatique réduit considérablement l'exposition aux instructions malveillantes.