Microsoft direktor nazvao AI skrejpovanje sadržaja “najvećom krađom rada u istoriji”

Otpečaćeni sudski dokumenti iz tužbe koju je New York Times podneo protiv OpenAI-ja i Microsoft-a otkrili su da je Brent Hekt (Brent Hecht), direktor primenjene nauke u Microsoft-u, još u januaru 2023. godine u internom memu praksu skrejpovanja sadržaja za treniranje AI modela nazvao „najvećom krađom rada u istoriji čovečanstva”. Dokumenti otkrivaju i da je čelnik ChatGPT-a u OpenAI-ju priznao da AI predstavlja „egzistencijalnu pretnju” za izdavače.

Kratak odgovor

U tužbi New York Times protiv OpenAI-ja i Microsoft-a, otpečaćeni interni dokumenti pokazuju da je Brent Hekt, direktor primenjene nauke u Microsoft-u, skrejpovanje sadržaja za treniranje AI modela opisao kao „zapanjujuću krađu neviđenih razmera” i „najveću krađu rada u istoriji čovečanstva”. Nik Torli (Nick Turley), čelnik ChatGPT-a u OpenAI-ju, u internoj prepisci je napisao da izdavači suočeni sa proizvodima poput ChatGPT-a doživljavaju „egzistencijalnu pretnju” jer su ti proizvodi „u velikoj meri zamenski” i da će „postajati sve više zamenski kako se poboljšavaju”.

Najvažnije

  • Otpečaćeni dokumenti iz tužbe New York Times protiv OpenAI-ja i Microsoft-a otkrivaju interni mejl Brenta Hekta, direktora primenjene nauke u Microsoft-u, iz januara 2023. godine.
  • Hekt je praksu skrejpovanja sadržaja za treniranje AI modela nazvao „najvećom krađom rada u istoriji čovečanstva” i „zapanjujućom krađom neviđenih razmera”.
  • Nik Torli, čelnik ChatGPT-a u OpenAI-ju, u internoj prepisci je priznao da proizvodi poput ChatGPT-a predstavljaju „egzistencijalnu pretnju” za izdavače jer postaju sve zamenljiviji za njihov sadržaj.
  • Dokumenti pokazuju da su OpenAI-jevi skupovi podataka za treniranje sadržali preko 91.692 kopije tekstova iz New York Times-a, Daily News-a i drugih istraživačkih medija, uz namerno uklanjanje oznaka autorskih prava.
  • Izvršni direktor Microsoft-a Sati Nadela (Satya Nadella) je pod zakletvom izjavio da bi sadržaj iza plaćenog zida trebalo da bude licenciran, dok je Copilot navodno smanjio stopu klikova ka New York Times sajtu i do 93% u odnosu na tradicionalnu pretragu.

Šta tačno otkrivaju otpečaćeni dokumenti

Tužba New York Times-a protiv OpenAI-ja i Microsoft-a, podneta pre tri godine, u međuvremenu je prikupila ogromnu količinu internih dokumenata koji su do sada bili delimično zapečaćeni. Novootpečaćeni delovi otkrivaju da su zaposleni obe kompanije bili svesni etičkih i pravnih problema skrejpovanja sadržaja mnogo pre nego što je to postalo predmet javne rasprave. Hektov mejl iz januara 2023. pokazuje da su ozbiljne sumnje o legalnosti i etičnosti prakse postojale unutar same Microsoft kompanije, mesecima pre nego što je tužba uopšte podneta.

Dokumenti dodatno navode da su timovi zaduženi za prikupljanje podataka za treniranje namerno uklanjali oznake autorskih prava iz materijala, kao i da su neki sadržaji prikupljani zaobilaženjem plaćenih zidova (paywall) izdavača. Ukupno je u skupovima podataka za treniranje pronađeno preko 91.692 kopije članaka iz New York Times-a, Daily News-a i drugih istraživačkih medijskih kuća.

Šta je rekao čelnik ChatGPT-a o izdavačima

Posebno osetljiv deo dokumenata odnosi se na izjave Nika Torlija, čelnika ChatGPT-a u OpenAI-ju, koji je u internoj komunikaciji napisao da proizvodi poput ChatGPT-a postaju „u velikoj meri zamenski” za sadržaj izdavača, i da će ta zamenljivost samo rasti kako se modeli poboljšavaju — što predstavlja „egzistencijalnu pretnju” za medijske kuće koje zavise od saobraćaja i prihoda sa svojih sajtova.

Ova priznanja dolaze u trenutku kada mnogi izdavači, uključujući velike medijske kuće, već prijavljuju drastičan pad saobraćaja usled toga što korisnici sve češće dobijaju odgovore direktno kroz AI alate poput ChatGPT-a ili Microsoft Copilot-a, bez potrebe da posete originalni sajt. Prema dokumentima, Copilot je prouzrokovao pad stope klikova ka New York Times sajtu i do 93% u poređenju sa tradicionalnom pretragom.

Šta je izjavio izvršni direktor Microsoft-a

Sati Nadela, izvršni direktor Microsoft-a, svedočio je pod zakletvom da bi sadržaj koji se nalazi iza plaćenog zida trebalo da bude licenciran — implicitno priznajući da neovlašćeno korišćenje takvog sadržaja predstavlja problem. Ova izjava dodatno komplikuje odbranu Microsoft-a u tužbi, s obzirom na to da interni dokumenti istovremeno pokazuju da su zaposleni kompanije bili svesni obima i etičkih implikacija prakse još 2023. godine. Ovakve rasprave o granicama i odgovornosti pri treniranju AI modela deo su šire debate o tome koliko AI kompanije treba da budu nadzirane spolja, ne samo u pogledu bezbednosti modela, već i u pogledu izvora podataka za njihovo treniranje.

Pitanje odgovornosti AI kompanija za posledice njihovih proizvoda nije ograničeno samo na autorska prava — slično se postavlja i kada je reč o AI halucinaciji koja je umalo izazvala ozbiljan vojni incident, gde je pitanje ko snosi odgovornost za grešku AI sistema jednako sporno kao i pitanje ko snosi odgovornost za korišćenje tuđeg sadržaja bez dozvole.

Slična pitanja o tome ko snosi odgovornost za AI proizvod pojavljuju se i u raspravi o tome da li je većina AI projekata u biznisu osuđena na propast upravo zbog nedovoljno jasnih pravila o podacima, vlasništvu i odgovornosti.

Najčešća pitanja

O kojoj tužbi je reč?

Reč je o tužbi koju je New York Times pre tri godine podneo protiv OpenAI-ja i Microsoft-a zbog navodnog neovlašćenog korišćenja autorskog sadržaja za treniranje AI modela.

Ko je rekao da je AI skrejpovanje „najveća krađa rada u istoriji”?

Brent Hekt, direktor primenjene nauke u Microsoft-u, u internom mejlu iz januara 2023. godine.

Šta je rekao čelnik ChatGPT-a o izdavačima?

Nik Torli je napisao da proizvodi poput ChatGPT-a predstavljaju „egzistencijalnu pretnju” za izdavače jer postaju sve zamenljiviji za njihov sadržaj kako se modeli poboljšavaju.

Koliko je članaka navodno korišćeno bez dozvole?

Dokumenti navode preko 91.692 kopije tekstova iz New York Times-a, Daily News-a i drugih istraživačkih medijskih kuća u skupovima podataka za treniranje.

Šta je izjavio Sati Nadela?

Izvršni direktor Microsoft-a je pod zakletvom izjavio da bi sadržaj iza plaćenog zida trebalo da bude licenciran, što je delimično priznanje problematičnosti prakse.


Izvor: TechCrunch

Više iz ove kategorije

Preporučeno

Google Discover u 2026: kako funkcioniše feed koji može da promeni pravila SEO-a

Google Discover ne čeka da korisnik ukuca upit — pokušava da predvidi šta ga zanima. Istražujemo savete Barryja Adamsa sa Belgrade SEO Conference 2026, zvanične Google smernice i šta izdavači mogu praktično da urade.

Kako smo od WordPress sajta napravili automatsku mašinu: Odmori365, partneri, mapa i AI

Kako smo Odmori365 pretvorili iz običnog WordPress portala u sistem u kome se partner unosi jednom, a zatim ulazi u profile, kartice, slider i mapu — uz sve greške, uska grla i lekcije koje smo usput napravili.

AI za frilensere i solo-preduzetnike

Najkraći odgovor: Ako...