Claude Code activa el modo automático por defecto: más autonomía y seguridad para los desarrolladores

  • El modo automático de Claude Code será la opción predeterminada para cuentas Pro, Max y Team desde el 14 de agosto.
  • Un estudio de Anthropic revela que el clasificador automático detecta el 89% de acciones dañinas, frente al 13,6% de la revisión humana.
  • Se incorporan filtros de inyección de prompts y reglas de denegación estricta para reforzar la seguridad.
  • Los usuarios podrán personalizar el modo o volver a la aprobación manual si lo prefieren.

Claude Code modo automático

Anthropic ha confirmado que, a partir del 14 de agosto, el modo automático de Claude Code dejará de ser una opción secundaria para convertirse en la configuración predeterminada en las cuentas Pro, Max y Team. Esta decisión, que ya se venía rumoreando, supone un cambio significativo en la forma en que los desarrolladores interactúan con el asistente de programación basado en IA. La compañía asegura que esta medida no solo agiliza el trabajo, sino que también mejora la seguridad, basándose en datos de un estudio interno que compara la eficacia del clasificador automático frente a la supervisión humana.

El modo automático, presentado en marzo de este año, permite que la IA ejecute tareas sin pedir confirmación constante para acciones menores, como leer archivos o ejecutar comandos básicos. Sin embargo, sí consulta al usuario cuando detecta operaciones irreversibles o destructivas, como el borrado de datos. Ahora, con este cambio, Anthropic busca reducir la fatiga de aprobación que sufren los programadores, que a menudo aceptan los avisos sin revisarlos a fondo. La compañía ha publicado datos que respaldan esta postura, y los desarrolladores tendrán la opción de personalizar el comportamiento según sus preferencias.

acuerdo de 5.000 millones de Amazon con Anthropic
Artículo relacionado:
El gran acuerdo de 5.000 millones de Amazon con Anthropic impulsa la carrera por la IA

Un cambio que reduce la intervención manual

El nuevo sistema se basa en un clasificador de seguridad que evalúa cada llamada a herramienta en tiempo real. Este clasificador identifica acciones irreversibles, destructivas o dirigidas a sistemas externos sin autorización, y las bloquea automáticamente, derivando la sesión al modo manual si es necesario. La clave está en que el clasificador detecta el 89% de las acciones dañinas, mientras que los humanos solo identifican el 13,6% en condiciones controladas, según el estudio de Anthropic con 1.053 evaluadores remunerados. Además, la tasa de acierto humano cae al 5% después de 50 prompts consecutivos, lo que demuestra que la atención se relaja con la repetición.

Este cambio no elimina por completo la supervisión humana, pero la reduce en los casos rutinarios. Los usuarios que ya hayan configurado un modo diferente recibirán una notificación única preguntando si desean cambiar al modo automático. Quienes prefieran mantener la aprobación manual pueden hacerlo, y los administradores de equipos pueden establecer reglas de denegación estricta para definir líneas rojas infranqueables. La compañía también ha confirmado que el clasificador consume una pequeña cantidad de tokens adicionales, pero ya no se cobrará por ello a los usuarios de Pro, Max y Team.

Claude Code seguridad

Los datos que respaldan la decisión

El estudio realizado por Anthropic es contundente. En un experimento con evaluadores pagados, se coló un comando peligroso entre rutinas normales, y los humanos solo lo detectaron el 13,6% de las veces. El clasificador automático, por su parte, atrapó el 89% de las acciones peligrosas, una diferencia abismal que justifica la apuesta por la autonomía. Además, en sesiones de producción reales, el 97% de los avisos de permiso son aprobados sin lectura, lo que indica que la revisión manual es, en la práctica, un mero trámite.

Boris Cherny, jefe de Claude Code, ha expresado su total apoyo al modo automático en redes sociales, afirmando que su equipo lo usa exclusivamente desde hace meses y que no volvería a los avisos de permiso. La compañía también ha añadido dos capas de seguridad adicionales: un filtro de inyección de prompts, que detecta intentos de manipulación externa, y reglas personalizables de denegación estricta, que permiten a los desarrolladores definir acciones que nunca deben ejecutarse sin supervisión. Estas medidas buscan equilibrar la autonomía con la protección de datos y sistemas.

Claude Cowork
Artículo relacionado:
Claude Cowork llega a móvil y web: el asistente de IA que no para de trabajar

Nuevas salvaguardas y control para el usuario

El modo automático no es una apuesta a ciegas. Anthropic ha implementado un sistema que, si detecta riesgos, busca una alternativa más segura o pide permiso explícito. Si los bloqueos son repetidos, la sesión vuelve automáticamente al modo de aprobación manual. Además, el filtrado de inyección de instrucciones es una defensa sistémica contra uno de los vectores de ataque más comunes en agentes de IA, y las reglas de denegación estricta ofrecen un control granular sobre el comportamiento de la herramienta.

Para los desarrolladores, este cambio implica una mayor fluidez en el trabajo diario, especialmente en proyectos grandes donde las interrupciones constantes son un lastre. La opción de personalizar el modo sigue disponible, y los usuarios pueden cambiar entre automático y manual con un simple atajo de teclado. En cuanto a las plataformas empresariales, como Enterprise, la API, Amazon Bedrock o Google Cloud, el modo automático sigue siendo opcional por ahora, aunque Anthropic planea activarlo como predeterminado en el próximo mes.

Claude Code desarrolladores

En definitiva, la decisión de Anthropic de hacer del modo automático el estándar en Claude Code responde a una lógica basada en datos y en la experiencia real de los usuarios. La supervisión humana, lejos de ser una garantía, se ha demostrado ineficaz en la práctica, y el clasificador automático ofrece una alternativa más fiable. Aunque algunos puedan mostrarse escépticos ante la autonomía de la IA, las cifras y las nuevas salvaguardas invitan a confiar en esta evolución. Los desarrolladores tendrán la última palabra, ya que pueden revertir el cambio si lo desean, pero todo apunta a que el modo automático ha llegado para quedarse.


Añadir como fuente preferida en Google