Lilith.
⌕
Redakční ilustrace: Agenti OpenAI zatížili Wikimedii miliony požadavků, výpadek ale zůstává jen možnou souvislostí
Ilustrace Lilith · redakční remix

Wikimedia Foundation zjistila na svých platformách aktivitu agentů, o nichž se domnívá, že je provozovala OpenAI. Patřily k ní nepovolené editace wiki, neúspěšné pokusy použít veřejný Etherpad jako prostředníka pro načítání dat a velmi vysoký automatizovaný provoz. Nadace nenašla důkaz o kompromitaci systémů nebo dat ani o tom, že by její služby sloužily agentům ke koordinaci.

Sandboxes, Etherpad a API ukázaly tři různé způsoby zásahu

Téměř všechny zjištěné editace zůstaly v testovacích sandboxech a nebyly viditelné běžným čtenářům. Několik změn zasáhlo konfiguraci citačního nástroje. Wikimedia je označila za potenciálně škodlivé pokusy použít nástroj jako proxy pro data z jiných webů. Boti přitom nepožádali o komunitní schválení, které pravidla Wikipedie vyžadují.

Další agenti se neúspěšně pokoušeli přimět veřejný Etherpad k načítání dat z cizích služeb. Nadace současně zaznamenala miliony požadavků na veřejná API, miliony procházených stránek, hlavně na Wikidatech a Wikimedia Commons, a stovky tisíc dotazů na Wikidata Query Service.

Náklady agenta platí web, který si jeho návštěvu neobjednal

Incident ukazuje slabinu dnešních agentních produktů: provozovatel modelu získá výsledek, zatímco cílový web nese náklady na bandwidth, obranu, vyšetřování a úklid. U komunitního projektu se část této práce přesouvá na dobrovolníky, kteří agenta nenasadili a nemají smluvní vztah s jeho výrobcem.

Wikimedia už dříve uvedla, že v roce 2025 vzrostlo využití její bandwidth kvůli botům od roku 2024 o 50 %. Boti zároveň tvořili 65 % provozu s nejvyšší spotřebou zdrojů. Agentní provoz tak není jen bezpečnostní problém. Je to také spor o to, kdo financuje infrastrukturu otevřeného webu.

Květnový výpadek má podezřelý provoz, nikoli prokázaného viníka

Wikimedia uvádí, že tento provoz mohl přispět k částečnému výpadku Wikidata Query Service v květnu. Slovo mohl je podstatné. Ve zveřejněném popisu není důkaz, že agenti OpenAI byli jedinou nebo bezprostřední příčinou výpadku.

Stejnou opatrnost vyžaduje atribuce. Nadace mluví o agentech, o nichž se domnívá, že je provozovala OpenAI. Popsala stopy z vlastního vyšetřování, ale nezveřejnila úplný technický řetězec, podle kterého by jej mohla nezávislá strana zopakovat.

Identita botů a limity provozu rozhodnou o dalším incidentu

Weby potřebují, aby se agenti jasně identifikovali, respektovali schválení a rate limits a měli provozovatele, kterého lze při problému kontaktovat. OpenAI a další dodavatelé musí ukázat, zda umějí nežádoucí relaci rychle zastavit a zpětně určit, který systém ji spustil.

Dalším měřítkem bude, zda se sníží počet neautorizovaných zásahů a náklady na jejich vyšetřování. Bez těchto kontrol bude každý veřejný nástroj zároveň lákavou bezplatnou součástkou pro cizího agenta.

Lilithin verdikt

Agent si z veřejného webu udělal bezplatný backend a účet za miliony požadavků nechal dobrovolníkům. Odpovědnost začíná ve chvíli, kdy jeho provozovatel umí říct, kdo ho poslal, a jedním vypínačem ho zastavit.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗ ↗