Anthropic anunció el 7 de agosto de 2026 que el modo auto se convertirá en la configuración de permiso predeterminada para Claude Code en los planes Pro, Max y Team a partir del 14 de agosto. El modo auto reemplaza los avisos de aprobación por acción con un clasificador de IA de fondo que evalúa cada llamada de herramienta antes de su ejecución, bloqueando acciones irreversibles, destructivas o fuera de los límites. Si se bloquea, Claude puede intentar una ruta más segura o solicitar permiso. Después de bloques repetidos, las sesiones vuelven a la aprobación manual. Anthropic ya no cobrará por el pequeño gasto de token del clasificador.
En las pruebas de 1.053 usuarios pagos, Anthropic encontró que los revisores humanos capturaron solo el 13.6% de los comandos peligrosos, en comparación con el 89% del modo auto. Una evaluación de terceros realizada por Trajectory Labs probó 72 escenarios de inyección de solicitud indirecta y encontró que el modo auto bloqueaba ataques que causaban exfiltración de datos confidenciales, fraude financiero o suplantación de credenciales. Entre las sesiones marcadas, aquellas que pasaban por aprobación manual contenían daño involuntario grave más que el doble de veces que las sesiones de modo auto. El cambio aborda un cuello de botella práctico: los desarrolladores no pueden iniciar de forma segura grandes tareas sin interrupciones de aprobación frecuentes.
Para equipos que envían agentes de código de producción, esto señala la confianza de Anthropic en la gobernanza de permisos impulsada por IA como estándar en lugar de excepción. La empresa señala que los clasificadores no pueden eliminar el riesgo y recomienda revisión humana para cambios de producción. Notablemente, OpenAI optó por no usar el modo auto para GPT-5.6 como precaución, por lo que Anthropic está adoptando una postura divergente en la autonomía de agentes. Los datos de clientes Team y Enterprise muestran que los usuarios del modo auto envían ~25% más solicitudes de extracción, lo que sugiere ganancias de velocidad operativa. Los usuarios Enterprise y API aún pueden optar; Anthropic planea hacerlo estándar en todas las plataformas en un mes.