Spory o to, z čeho se jazykové modely učily, často znějí jako právnická mlha s nekonečně dlouhými souvětími. Tohle rozhodnutí je ale velmi hmatatelné: Anthropic zaplatí 1,5 miliardy dolarů v hromadném sporu autorů knih a soud vyrovnání definitivně schválil.
Tři tisíce dolarů za knihu
Skupina autorů podala žalobu už v roce 2024. Tvrdila, že Anthropic trénoval své AI modely na knihách chráněných autorským právem, které společnost získala pirátskou cestou. Jádro sporu tedy není jen obecná otázka, zda se AI smí učit z cizích textů, ale také velmi přízemní otázka: odkud ty texty vůbec pocházely.
Federální soudkyně Araceli Martínez-Olguín vyrovnání schválila. Autorům má připadnout zhruba 3 000 dolarů za každou knihu, která byla údajně pirátsky získána. Právní kancelář zastupující žalobce jej označuje za největší známou náhradu škody v oblasti autorského práva. Tenhle superlativ bych brala s malou právnickou hvězdičkou, ale částka 1,5 miliardy dolarů je i bez ní dost hlasitá.
Anthropic už dříve získal částečné vítězství: dnes již penzionovaný soudce William Alsup rozlišil některé části případu. Vedle toho ale připustil hromadnou žalobu kvůli tomu, co bylo popsáno jako stahování milionů děl ve stylu Napsteru. Napster byl kdysi známá služba pro sdílení souborů, která se stala symbolem masového internetového pirátství. Zrovna tahle historická připomínka se technologické firmě v roce 2026 asi nečte úplně pohodlně.
Nejde jen o peníze, ale o původ dat
Mně na tom připadá nejdůležitější právě rozdíl mezi samotným trénováním a zdrojem trénovacích dat. Debata o tom, zda model při učení porušuje práva autora, je složitá a různé soudy k ní mohou dojít odlišně. Pirátské kopie jsou ovšem mnohem méně abstraktní problém. Firma může mít silné argumenty o tom, co model s textem dělá při tréninku; hůř se obhajuje cesta, při níž se knihy nejdřív prostě nelegálně stáhnou.
Vyrovnání navíc ukazuje, že trénovací data nejsou pro firmy jen technická surovina schovaná v obřím datovém skladu. Mohou se proměnit v konkrétní finanční riziko. A 1,5 miliardy dolarů není položka, kterou by šlo zastrčit mezi předplatné SaaS nástrojů a kávu do kanceláře.
Uzavřený případ neznamená konec sporů
Anthropic uvedl, že o svůj podíl už požádalo více než 91 procent autorů a nakladatelů zahrnutých do vyrovnání. To zní jako slušně dotažená administrativní část celé věci; každý, kdo někdy vyplňoval formulář pro pojišťovnu, ví, že i to je malý zázrak.
Celá autorskoprávní kapitola pro Anthropic tím ale nekončí. Firma stále čelí žalobám od Chicken Soup for the Soul a dalších autorů, kteří namítají, že přibližně 3 000 dolarů za knihu není dostatečné odškodnění. Z dostupných informací také neplyne, zda toto vyrovnání nějak přímo nastaví pravidla pro jiné žaloby proti AI firmám. Soudní dohoda totiž není totéž co rozsudek, který by detailně vyložil hranice zákona pro všechny ostatní.
Účet za „rychlejší“ cestu
Anthropic se tímto jedním případem pravděpodobně zbaví velkého a nepříjemného sporu, autoři získají reálné peníze. Pro celý obor je to ale hlavně připomínka, že původ dat není nudný dodatek pod čarou. Je to věc, která může rozhodovat o tom, zda se z trénování modelu stane produktový plán, nebo mimořádně drahý právní problém.
Já bych si přála, aby podobné případy vedly hlavně k čitelnějším licencím a férovějším způsobům, jak tvůrce za použití jejich práce odměnit. Zatím to vypadá spíš na to, že se pravidla budou rodit žalobu po žalobě. To je pomalé, drahé a ani trochu elegantní, ale alespoň už nejde dělat, že se otázka dat vyřeší sama.
