Satya Nadella prozvao Anthropic zbog dvostrukih standarda u treniranju umjetne inteligencije
Rasprava o tome tko ima pravo koristiti podatke za treniranje modela umjetne inteligencije dobila je novu dimenziju nakon što je izvršni direktor Microsofta Satya Nadella javno kritizirao, iako neizravno, tvrtku Anthropic zbog, kako smatra, dvostrukih standarda. Nadella je u objavi na društvenoj mreži X komentirao praksu velikih AI kompanija koje se pozivaju na pravo korištenja javno dostupnih internetskih podataka za razvoj vlastitih modela, dok istodobno pokušavaju spriječiti druge da koriste rezultate njihovih modela za treniranje konkurentskih sustava. Iako nije izrijekom spomenuo Anthropic, kontekst njegove objave jasno upućuje na tu tvrtku.
Anthropic je ranije optužio Alibabu
Početkom ove godine Anthropic je američkom Senatu poslao dopis u kojem je optužio kinesku tvrtku Alibaba za provođenje, kako su naveli, „najvećeg napada iskorištavanja do sada“. Prema tvrdnjama Anthropica, kineska je kompanija koristila odgovore koje generira AI model Claude za treniranje vlastitih modela umjetne inteligencije bez dopuštenja.
Izvršni direktor Anthropica Dario Amodei u više je navrata javno tvrdio da pojedine kineske AI tvrtke neovlašteno koriste intelektualno vlasništvo njegove kompanije. Anthropic je također najavio razvoj tehničkih mjera kojima želi otkriti i spriječiti takvu praksu.
Nadella: Ironično je da žele učiti od svih, ali ne dopuštaju drugima isto
Satya Nadella smatra da upravo u tome leži najveći paradoks današnje AI industrije. U objavi na X-u napisao je kako smatra “ironičnim” da pojedini proizvođači modela umjetne inteligencije traže zaštitu kroz načelo poštene uporabe (fair use) kada koriste javno dostupne internetske podatke za treniranje svojih modela, ali istodobno zabranjuju drugim tvrtkama da koriste rezultate njihovih modela za razvoj vlastitih sustava. Drugim riječima, prema Nadelli, žele učiti iz rada drugih, ali ne dopuštaju da drugi uče iz njihovog rada. Osim toga, istaknuo je kako mnoge AI kompanije zadržavaju pravo korištenja podataka nastalih tijekom interakcije korisnika s njihovim modelima za daljnje poboljšavanje vlastitih sustava.

Pitanje koje muči cijelu AI industriju
Nadellina kritika otvara jedno od najosjetljivijih pitanja današnjeg razvoja umjetne inteligencije. Modeli poput Claudea, ChatGPT-a i Geminija trenirani su na golemim količinama tekstova, slika i drugih sadržaja prikupljenih s interneta. U velikom broju slučajeva autori, izdavači i vlasnici tih sadržaja nisu dali pojedinačnu suglasnost za njihovo korištenje. Zbog takve prakse brojne medijske kuće, autori, umjetnici i druge organizacije posljednjih su godina pokrenuli sudske postupke protiv AI kompanija, tvrdeći da je riječ o povredi autorskih prava. S druge strane, kada su pojedine kineske tvrtke navodno koristile rezultate Claudea za treniranje vlastitih modela, Anthropic je takvu praksu opisao kao krađu intelektualnog vlasništva i zatražio reakciju američkih vlasti.
Nadella smatra da takav pristup stvara neravnotežu. Prema njegovu mišljenju, ako je prijenos znanja dopušten samo u jednom smjeru, najveću ekonomsku korist ostvarivat će tvrtke koje posjeduju najjaču AI infrastrukturu, dok će stvarni autori izvornog sadržaja ostati bez odgovarajuće naknade.
Elon Musk ranije je iznio slične kritike
Satya Nadella nije jedini koji je upozorio na ovu kontradikciju. Nakon što je Anthropic početkom godine javno optužio kineske tvrtke DeepSeek, MiniMax i Moonshot AI za neovlaštenu destilaciju AI modela, osnivač tvrtke xAI Elon Musk objavio je da je upravo Anthropic kompanija koja, prema njegovim riječima, „u velikim razmjerima koristi tuđe podatke za treniranje svojih modela“. Musk je tada ustvrdio da bi se Anthropic zbog toga mogao suočiti s višemilijardnim odštetnim zahtjevima, nazvavši svoju tvrdnju „činjenicom“.
Gdje završava učenje, a počinje kopiranje?
Rasprava koju su otvorili Nadella i Musk svodi se na jedno temeljno pitanje koje još nema jasan odgovor. Ako je prihvatljivo koristiti javno dostupne internetske podatke za razvoj modela umjetne inteligencije, može li se istodobno zabraniti drugim tvrtkama da koriste rezultate tih modela za razvoj vlastitih sustava?
Granica između legitimnog treniranja modela, poštene uporabe podataka i povrede intelektualnog vlasništva i dalje nije jasno definirana ni u zakonodavstvu ni u sudskoj praksi.
Anthropic se do trenutka objave nije javno očitovao o Nadellinim komentarima, no rasprava dodatno pokazuje koliko će pitanje vlasništva nad podacima i sadržajem biti jedno od ključnih pravnih i poslovnih izazova u razvoju umjetne inteligencije tijekom sljedećih godina.