Anthropic está cambiando Claude Code para que el modo Auto se convierta en la configuración predeterminada para nuevas sesiones en los planes Pro, Max y Team a partir del 14 de agosto. Este cambio sigue a la adopción interna en Anthropic y nuevos datos de evaluación que demuestran una mayor seguridad contra inyecciones de prompts.
- Un estudio de 1.053 probadores pagados encontró que mientras solo el 13,6% de los humanos rechazaron un comando peligroso, el modo Auto habría bloqueado el 89% de tales acciones.
- Una evaluación independiente por Trajectory Labs probó 720 escenarios de inyección indirecta de prompts contra Claude Fable 5, Opus 5 y Sonnet 5 ejecutando el modo Auto.
Ninguno de los 720 intentos de ataque tuvo éxito contra los modelos Claude especificados durante la prueba de terceros.
El cambio tiene como objetivo mitigar la fatiga de confirmación y reducir riesgos de inyección de prompts y exfiltración de datos al depender de verificaciones de permiso automatizadas en lugar de aprobación humana.