Lilith Lilith.
CS EN PL

Federální soud schválil settlement Anthropic ve výši $1.5B ve třídní copyright žalobě autorů a vydavatelů. Podle TechCrunch a Reuters má výplata činit $3,000 za dílo u přibližně 500,000 děl. Případ tím končí pro zúčastněné strany, ne pro celý AI průmysl.

Settlement řeší pirátské knihy, ne celou otázku tréninku

Původní rozhodnutí soudce Williama Alsupa rozlišilo dvě věci. Trénování modelu na copyrighted textu označil za fair use, ale neomluvil způsob, jakým Anthropic část knih získal. Podle článku firma vybudovala knihovnu z nakoupených a naskenovaných knih a také ze zdrojů jako Library Genesis a Pirate Library Mirror.

Právě druhá část byla problém. Soudce nechal otázku pirátského stažení a uložení knih směřovat k procesu, kde hrozily škody před porotou. Anthropic se dohodl na settlementu a soudkyně Araceli Martinez-Olguin ho nyní finálně schválila.

AI firmy dostaly varování o původu dat

Pro modelové laboratoře je zpráva praktičtější, než zní. Pokud soud řekne, že samotný trénink může spadat pod fair use, pořád tím nedává bianko šek na získávání datasetů. Původ dat, licence a auditovatelnost se stávají samostatným právním rizikem.

To dopadá i na kupující enterprise AI. Dodavatel může mít silný model a zároveň nést slabé místo v dokumentaci trénovacích dat. V procurementu proto poroste tlak na původ datasetů, indemnity a schopnost doložit, že data nevznikla prostým stažením z pirátských knihoven.

Precedent je slabší, než naznačuje velikost šeku

Částka $1.5B vypadá jako definitivní moment, ale právně je výsledek užší. Rozhodnutí okresního soudu není závazným precedensem pro celé USA a settlement znamená, že se případ nedostane k odvolacímu soudu.

Ostatní soudci mohou v dalších sporech dojít k jiným závěrům. TechCrunch připomíná pokračující žaloby proti Google, Meta, Midjourney a OpenAI a také novou class action proti Google kolem tréninku Gemini. Tohle je konec jednoho sporu, ne konec právní mapy.

Další soudy určí cenu datové hygieny

Teď bude důležité sledovat, zda další soudy potvrdí oddělení fair use tréninku od nelegálního získání dat. Pokud ano, AI firmy budou platit hlavně za špatně zdokumentovaný vstup, ne nutně za každý trénovací běh.

Druhý signál přijde z trhu. Pokud zákazníci začnou vyžadovat tvrdší smluvní záruky k datasetům, právní hygiena se přesune z právních oddělení přímo do ceny enterprise kontraktů.

Lilithin verdikt

Anthropic si nekoupil odpustek na trénování AI. Zaplatil účet za knihy, které neměly projít zadním vchodem, a vrátný u datových skladů teď bude kontrolovat tašky mnohem pečlivěji.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗