Anatomia unei amenințări existențiale
Într-o escaladare majoră a bătăliei privind drepturile de autor, care durează de trei ani între The New York Times, OpenAI și Microsoft, documente recent declasificate au aruncat o lumină nouă asupra atitudinii liderilor din tehnologie față de etica antrenării modelelor AI. Dezvăluirile sugerează că, în spatele ușilor închise, directorii au recunoscut că metodele lor de dezvoltare a modelelor generative ar putea submina chiar instituțiile care le furnizează datele. Printre cele mai grave dovezi se numără o notă internă din ianuarie 2023, în care directorul departamentului de Științe Aplicate din Microsoft, Brent Hecht, a caracterizat în mod explicit colectarea masivă de conținut creat de oameni drept „cel mai mare furt de muncă din istoria omenirii”.
Aceste documente sugerează o disonanță puternică între apărarea „utilizării loiale” (fair use), promovată public de laboratoarele de AI, și recunoașterea internă a daunelor competitive provocate instituțiilor de presă. Conducerea OpenAI a descris, se pare, propriile produse ca fiind o amenințare existențială la adresa jurnalismului, observând că chatbot-urile devin tot mai mult un substitut pentru materialele sursă pe care le consumă. Această schimbare reprezintă o provocare fundamentală pentru sustenabilitatea economică a internetului, datele interne ale Microsoft indicând faptul că instrumentele de căutare bazate pe AI ar putea reduce traficul către editorii tradiționali cu până la 93%.
De ce contează acest lucru
- Deplasarea economică: Documentele relevă discuții interne în Microsoft despre un „cerc vicios” în care motoarele de căutare bazate pe AI erodează traficul către editori, ceea ce, la rândul său, afectează performanța viitoare a modelelor AI.
- Ocolirea paywall-urilor: Există acuzații conform cărora cercetătorii OpenAI ar fi dezvoltat metode de a ocoli paywall-urile digitale pentru a alimenta seturile de date de antrenare, conducerea companiei fiind, se pare, la curent cu aceste „trucuri” la nivel intern.
- Amploarea utilizării datelor: Documentele cuantifică volumul masiv al colectării, un singur set de date conținând peste 160.000 de lucrări unice provenite de la editori de știri, adesea cu mențiunile privind drepturile de autor eliminate pentru a preveni apariția acestora în rezultatele generate de modele.
- Responsabilitatea corporativă: CEO-ul Microsoft, Satya Nadella, a declarat sub jurământ că respectivul conținut cu plată ar trebui licențiat, precizând că, dacă ar fi fost pe deplin conștient de amploarea colectării neautorizate, ar fi cerut reantrenarea modelelor.
La răscrucea dintre lege și etică
Nucleul disputei se concentrează pe întrebarea dacă antrenarea AI constituie „utilizare loială”, o doctrină juridică rezervată de obicei parodiei, reportajelor sau criticii. Totuși, dovezile prezentate în aceste dosare atacă pilonul „utilizării loiale” care impune ca o operă nouă să nu reprezinte un substitut pentru original. Recunoașterile personalului OpenAI sugerează că modelele lor sunt concepute explicit să funcționeze ca substituenți, menținând utilizatorii pe platforma AI în loc să îi direcționeze către editorii originali. Această fricțiune competitivă sugerează un viitor precar pentru ecosistemul de conținut digital.
Mai mult, detaliile logistice despre modul în care au fost colectate aceste date conturează o operațiune sistematică. De la utilizarea unor proiecte precum „Project Mango” și „Project Taxi” până la folosirea datelor din indexul Bing, documentele susțin existența unui efort extrem de coordonat de agregare a milioane de documente proprietare. Prin eliminarea, conform rapoartelor, a mențiunilor privind drepturile de autor înainte de procesare, companiile au încercat probabil să „igienizeze” rezultatele, sugerând o conștientizare a riscurilor juridice implicate. Pe măsură ce acest caz avansează, aceste declarații vor servi probabil drept dovezi esențiale, având potențialul de a reseta modul în care instanțele evaluează limitele inovației în raport cu protecția proprietății intelectuale în era AI-ului generativ.











