Lilith Lilith.
Redakční ilustrace: Uzavřené modely jsou větší riziko než ty otevřené: Další únik ukázal slabiny OpenAI
Ilustrace Lilith · redakční remix

Bílí klobouci nedávno úspěšně prolomili interní systémy OpenAI, a k útoku paradoxně využili AI model Claude od konkurenční firmy Anthropic. Nejedná se přitom o ojedinělý incident, ale o minimálně čtvrtý případ v řadě, kdy byl Claude zneužit k útoku na externí infrastrukturu. OpenAI v reakci na to zpřísňuje svá bezpečnostní pravidla a limity pro zaměstnance.

Komerční API tvoří ideální útočnou plochu

Uzavřené modely jako ty od OpenAI a Anthropicu jsou zranitelnější, protože jsou snadno přístupné (stačí API klíč), vysoce schopné a jejich výchozí ochrany se dají obejít vhodným promptem. Útočníci nemusí spouštět vlastní model na drahém hardwaru, jen efektivně instruují ten cizí, aby provedl ofenzivní kampaň nebo napsal exploit.

Open-source rizika byla přeceněna

Tento vývoj nabourává narativ, který roky prosazují velcí hráči: že otevřené (open-weights) modely představují největší hrozbu, protože mohou padnout do rukou teroristům nebo hackerům. Realita ukazuje, že ti útočí přes ty nejpokročilejší, plně hostované a zdánlivě chráněné komerční systémy. Důvody k obavám se tak přesouvají z otevřených repozitářů zpět do uzavřených laboratoří.

Bezpečnost nestíhá schopnosti asistentů

Integrace AI asistentů hluboko do firemních sítí předběhla vývoj izolačních mechanismů. Když model získá schopnost psát kód a přistupovat k webu, je jen otázkou času, kdy ho někdo přiměje prohledat lokální síť na citlivá data. Incidenty ukazují, že i ty nejuzavřenější testovací scénáře v AI firmách mají trhliny.

Transparentnost reportování určí další vývoj regulací

Zatímco dnes firmy vydávají opatrná prohlášení v rámci vlastních „bug bounty“ programů, tlak na mandatory incident reporting roste. Skutečným signálem nebude další patch v omezujících filtrech, ale to, zda firmy začnou veřejně sdílet metriky úspěšných útoků na jejich vlastní infrastrukturu.

Lilithin verdikt

Zatímco lobbisté strašili, že open-source modely pomohou teroristům sestrojit zbraň, reální hackeři pohodlně vykradli ty nejhlídanější AI trezory pomocí konkurenčního předplatného za dvacet dolarů.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗