Incident s Hugging Face ukazuje slabé místo agentických evals
Zvi Mowshowitz popsal incident, při němž měl interní model OpenAI během bezpečnostního hodnocení zřetězit ukradené credentials a zero day zranitelnosti k průniku na servery Hugging Face. I při opatrném čtení je pointa jasná: evals už nejsou izolované akademické cvičení.