Anthropic pone Claude Code en modo automático por defecto a partir del 14 de agosto
La herramienta de codificación por IA actuará de forma independiente y solo se pausará ante pasos verdaderamente riesgosos. En pruebas, ese enfoque detectó acciones dañinas mucho más confiablemente que los humanos.

Puntos clave
- Anthropic hará que el modo automático sea el predeterminado para las cuentas Pro, Max y Team de Claude Code a partir del 14 de agosto de 2026.
- En un estudio de 1.053 probadores pagos, el modo automático detectó el 89% de acciones dañinas; los revisores humanos solo detectaron el 13,6%.
- Los humanos aprobaron el 97% de los avisos de permisos durante la revisión manual, lo que sugiere que el clic rutinario había hecho que la supervisión fuera prácticamente inútil.
- Anthropic también está añadiendo detección de inyección de avisos y reglas de rechazo duro personalizables a Claude Code.
Los antropicistas han asumido durante mucho tiempo que mantener a un humano en el proceso hace que las herramientas de IA sean más seguras. Un nuevo estudio de Anthropic sugiere que lo opuesto puede ser cierto a veces, al menos cuando el humano en cuestión ha visto el mismo cuadro de aprobación cien veces hoy.
A partir del 14 de agosto, Claude Code, el asistente de codificación impulsado por IA de Anthropic que escribe, edita y ejecuta código en tu nombre, activará el modo automático de forma predeterminada para usuarios con planes Pro, Max y Team. El modo automático significa que la herramienta completa tareas de forma independiente y solo se detiene para solicitar permiso cuando una acción se clasifica como irreversible, destructiva o dirigida fuera de tus propios archivos y sistemas.
Anthropic probó por primera vez el modo automático en marzo de 2026, presentándolo como una forma de mantener el trabajo en movimiento sin sacrificar el control.
¿Por qué eliminar la aprobación humana en realidad hace las cosas más seguras?
Porque los humanos dejan de prestar atención. En el estudio de Anthropic, los usuarios aprobaron el 97% de todos los avisos de permiso que se les mostraron durante la revisión manual. Hacer clic en "sí" se había convertido en un hábito, no en una verificación genuina.
El modo automático, por el contrario, aplica reglas consistentes cada vez. En 1.053 probadores pagos, identificó correctamente el 89% de las acciones dañinas. Los revisores humanos detectaron solo el 13,6% de las mismas acciones.
Boris Cherny, jefe de Claude Code, lo expresó claramente en una publicación en X: "El equipo y yo usamos el modo automático exclusivamente y hemos estado haciéndolo durante muchos meses. No podría imaginarme volver a los avisos de permiso".
¿Qué deberían vigilar realmente los usuarios?
El modo automático no es una excusa para alejarte de tu computadora mientras Claude Code reescribe tu base de código.
La herramienta se pausa antes de acciones que juzga como irreversibles o destructivas, pero ese juicio lo hace la IA, no tú. Familiarizarte con las nuevas reglas de "rechazo duro", que te permiten bloquear categorías específicas de acciones completamente, vale la pena los diez minutos que toma.
Anthropic también está implementando detección de inyección de avisos. La inyección de avisos es un ataque en el que instrucciones maliciosas se ocultan dentro del contenido que lee la IA, como una página web o un documento, engañándola para que haga algo que su usuario nunca pidió. La nueva detección está diseñada para detectar esos comandos ocultos antes de que influyan en lo que hace la herramienta.
Si tu trabajo implica datos sensibles, archivos de clientes o sistemas de producción que no se pueden revertir fácilmente, establece tus reglas de rechazo duro antes del 14 de agosto. Trata el modo automático como un asistente capaz que trabaja rápido y necesita límites claros, no uno que necesite supervisión constante, pero tampoco uno que puedas ignorar completamente.



