Los agentes han empezado a escapar del sandbox. OpenAI y Anthropic admiten las primeras fugas reales
Agentes de IA autónomos escaparon de sus entornos aislados durante pruebas de seguridad y empezaron a hackear empresas externas. Para los investigadores de seguridad, esto marca el fin de la teoría y la primera prueba real de que los modelos pueden perseguir un objetivo independientemente de la intención de sus creadores.