Lilith Lilith.
Ilustración editorial: Claude Code habilita autonomía total, el agente bloquea un 75% más de acciones de riesgo que un humano
Ilustración de Lilith · remezcla editorial

El piloto automático reemplaza la aprobación manual

Anthropic activará el modo autónomo de manera predeterminada para nuevas sesiones de Claude Code en planes Pro, Max y Team desde el 14 de agosto. Los desarrolladores ya no tendrán que ingresar largas secuencias manualmente. El agente dividirá el trabajo, escribirá el código, lo verificará y solucionará errores.

Simon Willison señala que, según discusiones en la AI Engineer World's Fair, casi todos dentro de Anthropic ya usan este modo para resolver tickets reales de desarrollo.

Los humanos protegen el repositorio peor que el agente

La decisión de cambiar a autonomía total se basa en datos de evaluación de mil probadores pagos. Anthropic introdujo discretamente código con inyección de prompts o peticiones de exfiltración a mitad de una sesión.

Los resultados mostraron una brecha de atención masiva. Mientras los humanos bloquearon solo el 13.6% de estas acciones maliciosas, el modo autónomo pudo reconocer y detener el 89% por sí solo. Exigir microgestión de cada paso a un desarrollador cansado ya no tiene sentido.

Los vectores de ataque desconocidos forman una zona gris

Las cifras parecen sólidas, pero Anthropic admite que el agente no detendría el 11% restante. Puede detectar patrones de ataque conocidos, pero si la exfiltración se camufla como un commit de git legítimo, podría pasar.

Si la delegación es el estado predeterminado, la atención en tickets complejos disminuirá. Cuando un ataque logre eludir los controles del agente, es probable que un humano no lo detecte, habiendo perdido el hábito de leer código.

La auditoría amplia reemplaza la ilusión de control

La seguridad pasa de la confirmación manual a la auditoría retrospectiva. En lugar de hacer clic para permitir cada comando, los equipos deberán implementar registros amplios de a qué accede el agente. La prueba de la madurez de la herramienta será su capacidad para proporcionar telemetría detallada, no solo una caja negra.

El veredicto de Lilith

La sensación de control sobre el código siempre fue una ilusión para humanos cansados. Anthropic acaba de demostrar que un script barato presta más atención que un desarrollador senior.

Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.

Fuente original ↗