Anthropic está haciendo que el modo automático sea predeterminado para los usuarios de Claude Code. Este cambio será efectivo a partir del 14 de agosto para las cuentas Pro, Max y Team. El modo automático funcionará sin pedir confirmación al usuario en cada paso, interviniendo solo cuando se detecten acciones irreversibles, dañinas o que afecten a terceros.

Las pruebas de Anthropic muestran que el modo automático es más seguro que la revisión manual. En una prueba con 1,053 usuarios, el modo automático detectó el 89% de las acciones dañinas, mientras que la revisión manual solo encontró el 13,6%. Esto indica que los usuarios aprueban automáticamente el 97% de las confirmaciones solicitadas.

Anthropic también anunció la adición de características de seguridad adicionales. Estas incluyen reglas de rechazo personalizables para prevenir acciones como la inyección de prompts y la filtración de datos.