Meta popiera, že by stiahla takmer 2 400 pornofilmov na trénovanie AI: „Ak to niekto spravil, muselo to byť na osobné použitie,“ hovorí

Zdá sa, že už čoskoro budeme svedkami jedného z najkomickejších súdov v histórii.

Meta podľa spoločnosti Strike 3 kradne už roky kvalitné porno
Zdroj: AI, Vosveteit.sk

Keď sa povie „umelá inteligencia a porno“, väčšina ľudí si predstaví deepfake videá, nie Facebook. Ale presne to sa teraz deje, materská spoločnosť Meta čelí žalobe, podľa ktorej mala nelegálne sťahovať viac než 2 300 pornofilmov od značiek ako Vixen, Tushy, Blacked či Deeper, aby ich využila na trénovanie svojich AI systémov. Meta to popiera a tvrdí, že ak sa niečo také naozaj stalo, išlo len o „osobné použitie“, nie o žiadny tajný porno-algoritmus, informuje Techspot.

Žalobu na firmu Marka Zuckerberga podali v júli spoločnosti Strike 3 Holdings a Counterlife Media, známe mená v odvetví prémiovej erotiky. Tvrdia, že Meta od roku 2018 stiahla minimálne 2 369 videí cez BitTorrent a následne ich mala použiť na trénovanie svojich modelov. Celkovú škodu vyčíslili na 359 miliónov dolárov.

Odoberaj Vosveteit.sk cez Telegram a prihlás sa k odberu správ

Podnet pritom vznikol úplne inde, v inom súdnom spore, kde Meta čelila žalobe autorov kníh za nelegálne použitie ich diel v trénovacích datasetoch. Práve tam sa objavili záznamy o torrentovaní z firemných IP adries. To okamžite zaujalo Strike 3, ktorá má vlastné systémy na sledovanie porušovania autorských práv. Výsledok? Niekoľko IP adries priradených priamo k Mete a údajne aj „tajná sieť“ 2 500 skrytých IP adries, ktoré mali maskovať sťahovanie filmov.

tvar AI umela inteligencia
Zdroj: Alena Ivochkina / Shutterstock.com

Porno pre umelú inteligenciu?

Producenti tvrdia, že Meta chcela filmy využiť na trénovanie neohlásenej „dospeláckej“ verzie svojho AI systému Movie Gen, teda modelu schopného generovať realistické videá. V praxi by to znamenalo, že Meta mohla testovať schopnosť AI reprodukovať erotické scény či postavy. Firma to však odmieta s tým, že nič také nikdy neplánovala a jej AI nástroje majú striktne zakázané generovať sexuálny obsah.

Meta sa teraz snaží celý prípad zamietnuť ešte pred pojednávaním. Tvrdí, že žaloba stojí na absurdných základoch.

„Ak aj niekto niečo sťahoval, bolo to pre osobné použitie, nie pre výskum alebo vývoj umelej inteligencie,“ argumentuje firma.

Dodáva, že sledované obdobie, od roku 2018, ani nedáva zmysel, pretože vývoj vlastných LLM modelov začala až v roku 2022.

Meta má dnes desaťtisíce zamestnancov, externistov a návštevníkov, ktorí sa pripájajú cez jej firemné siete. To podľa firmy úplne znemožňuje určiť, kto konkrétne mohol torrent spustiť. Navyše, počet stiahnutí je podľa nej zanedbateľný, v priemere len 22 videí ročne, rozložených medzi desiatky IP adries.

V spisoch sa dokonca objavil prípad jedného kontraktora, ktorý mal sťahovať erotické videá z domu svojho otca. Meta tvrdí, že nešlo o človeka, ktorý by mal čo do činenia s trénovaním AI, a preto je jasné, že išlo o čisto osobnú aktivitu.

Firma preto považuje žalobu za nezmyselnú a dodáva, že Strike 3 Holdings má v právnickom svete pochybnú reputáciu . Mnohí ju označujú za „copyright trolla“, ktorý hromadne podáva žaloby s cieľom vymáhať peniaze mimosúdne.

logo spolocnosti Meta

Prečo by AI vôbec potrebovala porno?

Tu sa dostávame k zaujímavejšiemu jadru problému, prečo sa technologické firmy vôbec uchyľujú k používaniu pirátskeho obsahu. Tréning veľkých multimodálnych modelov, ako je napríklad Movie Gen, si vyžaduje obrovské množstvo rôznorodých dát. Umelá inteligencia sa totiž učí rozumieť všetkým formám ľudskej činnosti, od bežných rozhovorov až po extrémne a intímne situácie.

Obsah pre dospelých preto predstavuje špecifickú a rozsiahlu časť ľudskej reality, ktorú modely musia vedieť identifikovať, ak nie kvôli generovaniu, tak aspoň kvôli jej správnemu rozpoznaniu, filtrovanie či cenzúre. V praxi to znamená, že systém, ktorý má vedieť, čo nemá generovať, musí na tom byť aj čiastočne natrénovaný.

Licencovaný erotický obsah je však pre vývoj AI prakticky nedostupný, autorsky chránený, drahý a právne komplikovaný. Preto sa niektoré firmy (alebo jednotlivci v ich radoch) môžu uchýliť k nelegálnym datasetom z torrentov či warezu. Tým síce získajú rozmanité dáta, no zároveň riskujú obvinenie z pirátstva.

AI, pirátstvo a hranice zákona

Meta nie je prvá ani posledná technologická firma, ktorú podobné obvinenia postihli. V auguste napríklad spoločnosť Anthropic (konkurent OpenAI) súhlasila so zaplatením 1,5 miliardy dolárov autorom, ktorých knihy použila bez povolenia pri trénovaní svojich modelov. Apple čelí od septembra podobnej žalobe – tiež za používanie pirátskych kníh na výcvik svojho jazykového modelu OpenELM.

mark zuckerberg facebook
Zdroj: flickr.com (Anthony Quintano), (CC BY 2.0), úprava Vosveteit.sk

Tréning AI na chránených dielach sa stáva novou právnou mínou, firmy tvrdia, že ide o „fair use“, zatiaľ čo autori hovoria o systematickej krádeži. Tento prípad je však úplne iný. Namiesto literatúry ide o pornografiu, teda obsah, ktorý má špecifický právny aj etický status.

Ak by sa obvinenia potvrdili, Meta by čelila nielen astronomickej pokute, ale aj obrovskému reputačnému škandálu. Predstava, že Facebook či Instagram využívali pornofilmy na vylepšovanie svojich AI modelov, by bola pre značku doslova toxická.

Meta však trvá na tom, že žiadne dôkazy o použití erotických videí vo vývoji AI neexistujú. Tvrdí, že celé obvinenie „nedáva zmysel“ a má byť zamietnuté „s predsudkom“, teda bez možnosti ďalšieho obnovenia prípadu.

Ak súd súhlasí, kauza sa môže skončiť ešte skôr, než sa začne. Ak nie, môžeme sa tešiť na jeden z najbizarnejších súdnych procesov v histórii umelej inteligencie, kde sa bude rozhodovať o tom, či sa Zuckerbergova AI učila z porna.

Google News Pridaj si Vosveteit.sk medzi obľúbené zdroje v Google News Pridať