Anthropic ha confirmado que, a partir del 14 de agosto, el modo automático de Claude Code dejará de ser una opción secundaria para convertirse en la configuración predeterminada en las cuentas Pro, Max y Team. Esta decisión, que ya se venía rumoreando, supone un cambio significativo en la forma en que los desarrolladores interactúan con el asistente de programación basado en IA. La compañía asegura que esta medida no solo agiliza el trabajo, sino que también mejora la seguridad, basándose en datos de un estudio interno que compara la eficacia del clasificador automático frente a la supervisión humana.
El modo automático, presentado en marzo de este año, permite que la IA ejecute tareas sin pedir confirmación constante para acciones menores, como leer archivos o ejecutar comandos básicos. Sin embargo, sí consulta al usuario cuando detecta operaciones irreversibles o destructivas, como el borrado de datos. Ahora, con este cambio, Anthropic busca reducir la fatiga de aprobación que sufren los programadores, que a menudo aceptan los avisos sin revisarlos a fondo. La compañía ha publicado datos que respaldan esta postura, y los desarrolladores tendrán la opción de personalizar el comportamiento según sus preferencias.
Un cambio que reduce la intervención manual
El nuevo sistema se basa en un clasificador de seguridad que evalúa cada llamada a herramienta en tiempo real. Este clasificador identifica acciones irreversibles, destructivas o dirigidas a sistemas externos sin autorización, y las bloquea automáticamente, derivando la sesión al modo manual si es necesario. La clave está en que el clasificador detecta el 89% de las acciones dañinas, mientras que los humanos solo identifican el 13,6% en condiciones controladas, según el estudio de Anthropic con 1.053 evaluadores remunerados. Además, la tasa de acierto humano cae al 5% después de 50 prompts consecutivos, lo que demuestra que la atención se relaja con la repetición.
Este cambio no elimina por completo la supervisión humana, pero la reduce en los casos rutinarios. Los usuarios que ya hayan configurado un modo diferente recibirán una notificación única preguntando si desean cambiar al modo automático. Quienes prefieran mantener la aprobación manual pueden hacerlo, y los administradores de equipos pueden establecer reglas de denegación estricta para definir líneas rojas infranqueables. La compañía también ha confirmado que el clasificador consume una pequeña cantidad de tokens adicionales, pero ya no se cobrará por ello a los usuarios de Pro, Max y Team.

Los datos que respaldan la decisión
El estudio realizado por Anthropic es contundente. En un experimento con evaluadores pagados, se coló un comando peligroso entre rutinas normales, y los humanos solo lo detectaron el 13,6% de las veces. El clasificador automático, por su parte, atrapó el 89% de las acciones peligrosas, una diferencia abismal que justifica la apuesta por la autonomía. Además, en sesiones de producción reales, el 97% de los avisos de permiso son aprobados sin lectura, lo que indica que la revisión manual es, en la práctica, un mero trámite.
Boris Cherny, jefe de Claude Code, ha expresado su total apoyo al modo automático en redes sociales, afirmando que su equipo lo usa exclusivamente desde hace meses y que no volvería a los avisos de permiso. La compañía también ha añadido dos capas de seguridad adicionales: un filtro de inyección de prompts, que detecta intentos de manipulación externa, y reglas personalizables de denegación estricta, que permiten a los desarrolladores definir acciones que nunca deben ejecutarse sin supervisión. Estas medidas buscan equilibrar la autonomía con la protección de datos y sistemas.
Nuevas salvaguardas y control para el usuario
El modo automático no es una apuesta a ciegas. Anthropic ha implementado un sistema que, si detecta riesgos, busca una alternativa más segura o pide permiso explícito. Si los bloqueos son repetidos, la sesión vuelve automáticamente al modo de aprobación manual. Además, el filtrado de inyección de instrucciones es una defensa sistémica contra uno de los vectores de ataque más comunes en agentes de IA, y las reglas de denegación estricta ofrecen un control granular sobre el comportamiento de la herramienta.
Para los desarrolladores, este cambio implica una mayor fluidez en el trabajo diario, especialmente en proyectos grandes donde las interrupciones constantes son un lastre. La opción de personalizar el modo sigue disponible, y los usuarios pueden cambiar entre automático y manual con un simple atajo de teclado. En cuanto a las plataformas empresariales, como Enterprise, la API, Amazon Bedrock o Google Cloud, el modo automático sigue siendo opcional por ahora, aunque Anthropic planea activarlo como predeterminado en el próximo mes.
En definitiva, la decisión de Anthropic de hacer del modo automático el estándar en Claude Code responde a una lógica basada en datos y en la experiencia real de los usuarios. La supervisión humana, lejos de ser una garantía, se ha demostrado ineficaz en la práctica, y el clasificador automático ofrece una alternativa más fiable. Aunque algunos puedan mostrarse escépticos ante la autonomía de la IA, las cifras y las nuevas salvaguardas invitan a confiar en esta evolución. Los desarrolladores tendrán la última palabra, ya que pueden revertir el cambio si lo desean, pero todo apunta a que el modo automático ha llegado para quedarse.

