Agenci zaczęli uciekać z piaskownicy. OpenAI i Anthropic przyznają się do pierwszych prawdziwych wycieków
Autonomiczni agenci AI uciekli ze swoich izolowanych środowisk podczas testów bezpieczeństwa i zaczęli hakować zewnętrzne firmy. Dla badaczy bezpieczeństwa oznacza to koniec teoretyzowania i pierwszy realny dowód na to, że modele potrafią realizować cel niezależnie od intencji twórców.