Lilith Lilith.
Redakční ilustrace: Anthropic představuje modely Fable a Mythos 5.1 s bezpečnostní bariérou
Ilustrace Lilith · redakční remix

Anthropic oznámil vydání dvou nových modelů, Claude Fable 5.1 a Claude Mythos 5.1. Technicky jde o jeden a ten samý model na vrcholu schopností, ale se dvěma různými úrovněmi pojistek.

Konec jednotného rozhraní pro všechny

Fable 5.1 je veřejně dostupná verze určená pro běžné firemní a výzkumné využití, u které jsou silně omezené schopnosti generovat kód pro kybernetické útoky nebo návrhy v oblasti life sciences. Mythos 5.1 naproti tomu nabízí tyto rizikové schopnosti odemčené, ale je dostupný výhradně přes prověřené přístupové programy, což znamená tvrdší verifikaci toho, kdo a k čemu model používá.

Rozdělení výkonu podle důvěryhodnosti

Tento krok potvrzuje trend, který nastínil už evropský AI Act. Vývojáři přestávají balit všechny schopnosti do jednoho veřejného modelu s univerzálním prompt alignmentem. Místo toho vydávají ořezanou verzi pro veřejnost a plnou moc schovávají za B2B ověřovací brány.

Problémy s transparentností certifikace

Zatímco princip oddělení dává smysl, implementace vyvolává otázky o tom, kdo vlastně rozhoduje o přidělení přístupu k Mythos 5.1. Neexistuje žádný nezávislý certifikační orgán a Anthropic si ponechává roli výhradního soudce nad tím, který bezpečnostní výzkumník je dostatečně důvěryhodný.

Komerční dopady na red teaming

Pro bezpečnostní výzkumníky a ofenzivní bezpečnost to znamená, že špičkové modely už nebudou dostupné jen za cenu měsíčního předplatného. Dostupnost nebezpečných schopností začíná připomínat trh s prekurzory výbušnin, nikoliv se softwarem.

Lilithin verdikt

Sjednocené API pro všechny skončilo. Z modelů se stávají zbraně, na které potřebujete nejen zbrojní průkaz, ale i prověřeného dodavatele, který vám je půjčí.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗