
Anthropic está cambiando la forma en que la mayoría de los clientes de pago usan Claude Code, y hará que su Modo Auto sea el predeterminado para las cuentas Pro, Max y Team a partir del 14 de agosto. La configuración permite que el agente de programación siga trabajando sin pedir aprobación por cada acción, mientras un clasificador de seguridad interviene cuando una operación parece irreversible, destructiva o fuera del entorno del usuario.
La medida reduce el número de solicitudes rutinarias de permiso que ven los desarrolladores y le da a Claude Code más libertad para editar archivos, ejecutar comandos y continuar tareas de varios pasos. Los clientes empresariales seguirán teniendo que activarlo manualmente, según The Decoder. Para los equipos de ingeniería, el cambio no trata tanto de una nueva función de programación como de dónde recae la responsabilidad: cada vez más, los desarrolladores supervisarán el trabajo de un agente en lugar de aprobar cada operación individual.
Anthropic introdujo por primera vez el Modo Auto como una prueba en marzo, presentándolo como un compromiso entre la ejecución autónoma y el control manual. En el flujo de trabajo anterior basado en aprobaciones, Claude Code se detenía con frecuencia y pedía al usuario autorizar las acciones propuestas. En cambio, el Modo Auto permite las acciones por defecto, salvo que el clasificador del sistema identifique un riesgo significativo.
Anthropic describió las categorías protegidas como acciones que son “irreversibles, destructivas o dirigidas fuera de tu entorno”, según la cobertura de TechCrunch. El límite exacto dependerá del juicio del clasificador y de la configuración del proyecto, por lo que el Modo Auto no elimina la necesidad de que los desarrolladores entiendan a qué puede acceder el agente.
Anthropic también dijo que ha añadido un filtrado de inyección de prompts y reglas de denegación dura personalizables. Esos controles están pensados para impedir que instrucciones hostiles incrustadas en código, documentos u otro contenido del proyecto desvíen al agente hacia acciones como la exfiltración de datos.
El responsable de Claude Code en la empresa, Boris Cherny, dijo en X que él y su equipo habían usado exclusivamente el Modo Auto durante meses y no querían volver a las solicitudes de permiso. Eso es una aprobación ejecutiva, no una prueba independiente de que la configuración sea adecuada para todos los entornos de desarrollo.
Anthropic dice que el Modo Auto rindió mejor que la aprobación manual en un estudio con 1.053 evaluadores de pago. La empresa informó que el sistema automatizado identificó el 89 % de las acciones dañinas, frente al 13,6 % detectado mediante revisión humana. Anthropic también dijo que los usuarios aprobaron el 97 % de las solicitudes de permiso de Claude Code, lo que sugiere que las aprobaciones repetitivas pueden convertirse en hábito en lugar de ser evaluadas con cuidado.
Esas cifras son resultados informados por el proveedor. La cobertura disponible no ofrece la metodología completa de la prueba, la definición de una acción dañina ni suficientes detalles para determinar hasta qué punto el estudio refleja a equipos de software en producción. Por tanto, los resultados respaldan el argumento de Anthropic para cambiar el valor predeterminado, pero no son una prueba general de que la aprobación automatizada sea más segura en todos los repositorios o canales de despliegue.
The Decoder también informó de una afirmación de Anthropic según la cual los equipos que usan el Modo Auto generaron alrededor de un 25 % más de pull requests. Eso puede indicar un mayor rendimiento, pero el volumen de pull requests no es lo mismo que software útil, seguro o mantenible. Una ejecución más autónoma puede aumentar la producción y también la carga de revisión si los cambios generados son difíciles de entender.
The Decoder citó además una auditoría independiente de Trajectory Labs de 72 escenarios de inyección de prompts, cada uno probado diez veces. Informó que ninguno de los 720 intentos tuvo éxito contra los modelos Claude probados en Modo Auto, mientras que algunos intentos sí tuvieron éxito contra el modo Auto-Review de Codex de OpenAI. Como la evidencia se presenta a través de cobertura mediática y no mediante un informe de auditoría proporcionado, los lectores deberían tratar la comparación como un resultado de prueba reportado y no como una clasificación definitiva de la seguridad de los agentes de programación.
Anthropic ha descrito incidentes internos en los que Auto Mode impidió que Claude subiera datos confidenciales a una página pública y terminó aproximadamente 2.000 procesos que podrían haber interferido con trabajos de entrenamiento de GPU. Estos son ejemplos de empresa sobre el valor del clasificador, no mediciones de fiabilidad verificadas de forma independiente.
El efecto inmediato para los clientes Pro, Max y Team es conductual. Los desarrolladores que no cambien la configuración recibirán una experiencia de Claude Code más autónoma después del 14 de agosto. Los equipos tendrán que decidir qué repositorios, credenciales, comandos de shell y rutas de red puede usar el agente antes de tratar el nuevo valor predeterminado como una mejora rutinaria de productividad.
Para los equipos de producto y las startups, el Modo Auto podría facilitar la delegación de tareas de larga duración. Un agente puede avanzar a través de una secuencia de ediciones y pruebas sin esperar a que una persona apruebe cada paso de bajo riesgo. Eso puede ayudar a los equipos con refactorizaciones repetitivas, creación de pruebas, cambios de documentación y otros trabajos acotados.
La desventaja es que una ejecución más rápida puede hacer que los fallos se propaguen más deprisa. Anthropic sigue recomendando revisar las acciones de Claude para infraestructuras de producción de alto riesgo. Esa advertencia es importante: un clasificador puede bloquear un comportamiento obviamente destructivo sin entender el impacto empresarial de un comando válido, una regresión de seguridad sutil o un cambio que sea técnicamente reversible pero costoso desde el punto de vista operativo.
La distinción entre cuentas empresariales y no empresariales también importa. Los compradores corporativos suelen necesitar controles más estrictos, capacidad de auditoría, integración de identidad y políticas predecibles en muchos repositorios. Mantener el Modo Auto como una opción para esos clientes sugiere que Anthropic reconoce que los valores predeterminados autónomos afrontan un listón más alto en entornos regulados o críticos para producción.
El cambio también intensifica la competencia entre las herramientas de programación con IA. Si los usuarios de Claude Code se acostumbran a supervisar agentes en lugar de aprobar comandos individuales, los productos competidores podrían ser evaluados menos por la calidad del autocompletado y más por sus clasificadores de seguridad, controles de políticas, trazabilidad y capacidad para recuperarse de los errores. Eso desplaza el mercado hacia la gobernanza de agentes como capacidad central del producto.
La primera señal será cuántos clientes dejan activado el Modo Auto después del cambio del valor predeterminado. Anthropic no ha proporcionado datos de adopción independientes, por lo que las cifras de uso futuras deberían separarse de las afirmaciones de productividad informadas por la empresa.
Los desarrolladores también deberían vigilar informes de incidentes relacionados con inyección de prompts, exposición accidental de datos, comandos destructivos o cambios en la infraestructura de producción. La prueba práctica será si el clasificador detecta fallos matizados, no solo operaciones de shell claramente peligrosas.
Otras señales importantes incluyen si Anthropic amplía el Modo Auto a cuentas Enterprise, publica más detalles sobre su metodología de pruebas y ofrece a los administradores mejores controles sobre repositorios, herramientas, credenciales y acceso a la red. Los equipos que evalúen la función deberían medir el tiempo de revisión, la frecuencia de reversión, las tasas de defectos y los hallazgos de seguridad junto con el volumen de pull requests.
La decisión de Anthropic convierte la autonomía en el flujo de trabajo normal de Claude Code para la mayoría de los usuarios de pago, pero no hace opcional la supervisión. Cambia la supervisión de una secuencia de microaprobaciones a una responsabilidad más amplia de configurar permisos, revisar diffs y validar resultados.
Esa es una dirección sensata cuando los avisos repetitivos fomentan la aprobación automática, pero la calidad de la capa de seguridad determinará si la ganancia de productividad es real. Los creadores deberían tratar el Modo Auto como una configuración de despliegue controlada, no como una decisión de confianza total: empezar con repositorios acotados, aplicar reglas de denegación dura, limitar el acceso a sistemas sensibles y conservar la revisión humana para los cambios en producción.
Anthropic hará que el Modo Auto de Claude Code sea el valor predeterminado para usuarios Pro, Max y Team el 14 de agosto, trasladando la supervisión de la programación hacia aprobaciones gestionadas por IA.