Inteligenta ArtificialaAnaliza tehnica

Documente interne dezvăluie că directori din Microsoft și OpenAI au catalogat colectarea datelor pentru AI drept „furt”

Publicat
RRedactia ElectricBuzz
Documente interne dezvăluie că directori din Microsoft și OpenAI au catalogat colectarea datelor pentru AI drept „furt”
3 min de citit574 cuvinteRedactia ElectricBuzz

Pe scurt

Documente judiciare recent declasificate din procesul intentat de The New York Times scot la iveală îngrijorări interne privind faptul că practicile de antrenare a modelelor AI reprezintă o „amenințare existențială” la adresa editorilor.

Anatomia unei amenințări existențiale

Într-o escaladare majoră a bătăliei privind drepturile de autor, care durează de trei ani între The New York Times, OpenAI și Microsoft, documente recent declasificate au aruncat o lumină nouă asupra atitudinii liderilor din tehnologie față de etica antrenării modelelor AI. Dezvăluirile sugerează că, în spatele ușilor închise, directorii au recunoscut că metodele lor de dezvoltare a modelelor generative ar putea submina chiar instituțiile care le furnizează datele. Printre cele mai grave dovezi se numără o notă internă din ianuarie 2023, în care directorul departamentului de Științe Aplicate din Microsoft, Brent Hecht, a caracterizat în mod explicit colectarea masivă de conținut creat de oameni drept „cel mai mare furt de muncă din istoria omenirii”.

Aceste documente sugerează o disonanță puternică între apărarea „utilizării loiale” (fair use), promovată public de laboratoarele de AI, și recunoașterea internă a daunelor competitive provocate instituțiilor de presă. Conducerea OpenAI a descris, se pare, propriile produse ca fiind o amenințare existențială la adresa jurnalismului, observând că chatbot-urile devin tot mai mult un substitut pentru materialele sursă pe care le consumă. Această schimbare reprezintă o provocare fundamentală pentru sustenabilitatea economică a internetului, datele interne ale Microsoft indicând faptul că instrumentele de căutare bazate pe AI ar putea reduce traficul către editorii tradiționali cu până la 93%.

De ce contează acest lucru

  • Deplasarea economică: Documentele relevă discuții interne în Microsoft despre un „cerc vicios” în care motoarele de căutare bazate pe AI erodează traficul către editori, ceea ce, la rândul său, afectează performanța viitoare a modelelor AI.
  • Ocolirea paywall-urilor: Există acuzații conform cărora cercetătorii OpenAI ar fi dezvoltat metode de a ocoli paywall-urile digitale pentru a alimenta seturile de date de antrenare, conducerea companiei fiind, se pare, la curent cu aceste „trucuri” la nivel intern.
  • Amploarea utilizării datelor: Documentele cuantifică volumul masiv al colectării, un singur set de date conținând peste 160.000 de lucrări unice provenite de la editori de știri, adesea cu mențiunile privind drepturile de autor eliminate pentru a preveni apariția acestora în rezultatele generate de modele.
  • Responsabilitatea corporativă: CEO-ul Microsoft, Satya Nadella, a declarat sub jurământ că respectivul conținut cu plată ar trebui licențiat, precizând că, dacă ar fi fost pe deplin conștient de amploarea colectării neautorizate, ar fi cerut reantrenarea modelelor.

La răscrucea dintre lege și etică

Nucleul disputei se concentrează pe întrebarea dacă antrenarea AI constituie „utilizare loială”, o doctrină juridică rezervată de obicei parodiei, reportajelor sau criticii. Totuși, dovezile prezentate în aceste dosare atacă pilonul „utilizării loiale” care impune ca o operă nouă să nu reprezinte un substitut pentru original. Recunoașterile personalului OpenAI sugerează că modelele lor sunt concepute explicit să funcționeze ca substituenți, menținând utilizatorii pe platforma AI în loc să îi direcționeze către editorii originali. Această fricțiune competitivă sugerează un viitor precar pentru ecosistemul de conținut digital.

Mai mult, detaliile logistice despre modul în care au fost colectate aceste date conturează o operațiune sistematică. De la utilizarea unor proiecte precum „Project Mango” și „Project Taxi” până la folosirea datelor din indexul Bing, documentele susțin existența unui efort extrem de coordonat de agregare a milioane de documente proprietare. Prin eliminarea, conform rapoartelor, a mențiunilor privind drepturile de autor înainte de procesare, companiile au încercat probabil să „igienizeze” rezultatele, sugerând o conștientizare a riscurilor juridice implicate. Pe măsură ce acest caz avansează, aceste declarații vor servi probabil drept dovezi esențiale, având potențialul de a reseta modul în care instanțele evaluează limitele inovației în raport cu protecția proprietății intelectuale în era AI-ului generativ.

The 5 Best Over-Ear ANC Headphones of 2026, Tested & Ranked
Ghid Cumpărături Recomandat
92/100
Tech si Gadgeturi12 min de citit

The 5 Best Over-Ear ANC Headphones of 2026, Tested & Ranked

We locked five over-ear ANC picks for 2026 — Sony WH-1000XM6, Bose QuietComfort Ultra 2, Soundcore Space One, Sennheiser Momentum 5, and Apple AirPods Max 2 — then stress-tested them on lab metrics, long-term owner truth, and live street prices.

Articole similare

Articole asemanatoare, ordonate semantic dupa subiect si actualitate.

Demistificarea performanței AI: Cum să îți construiești propriul clasament pe Hugging Face
Inteligenta Artificiala

Demistificarea performanței AI: Cum să îți construiești propriul clasament pe Hugging Face

Hugging Face a lansat un ghid complet pentru crearea de clasamente personalizate, oferind dezvoltatorilor posibilitatea de a evalua modele AI specializate, precum instrumentul Vectara pentru detectarea halucinațiilor.

Unsloth și TRL de la Hugging Face: o nouă eră pentru fine-tuning-ul accelerat al modelelor LLM
Inteligenta Artificiala

Unsloth și TRL de la Hugging Face: o nouă eră pentru fine-tuning-ul accelerat al modelelor LLM

Hugging Face și Unsloth și-au unit forțele pentru a optimiza procesul de fine-tuning, permițând dezvoltatorilor să antreneze modele lingvistice mari de două ori mai rapid.

Manus își recapătă independența: startup-ul de AI țintește o evaluare de 4 miliarde de dolari după blocarea fuziunii cu Meta
Inteligenta Artificiala

Manus își recapătă independența: startup-ul de AI țintește o evaluare de 4 miliarde de dolari după blocarea fuziunii cu Meta

După eșecul achiziției de către Meta, startup-ul chinez de AI Manus își trasează un nou drum printr-o rundă de finanțare masivă de 500 de milioane de dolari și planuri pentru o posibilă listare la bursa din Hong Kong.

Google transformă agentul AI „CC” într-un administrator al gospodăriei
Inteligenta Artificiala

Google transformă agentul AI „CC” într-un administrator al gospodăriei

Google repoziționează agentul său AI, „CC”, pentru a funcționa ca un centru de comandă centralizat al gospodăriei, conceput pentru a sincroniza calendarele, a gestiona logistica școlară și a automatiza sarcinile administrative ale familiei.

Controlul avansului AI: Pot giganții tehnologici să se autoregleze?
Inteligenta Artificiala

Controlul avansului AI: Pot giganții tehnologici să se autoregleze?

CEO-ul Anthropic, Dario Amodei, a propus un nou cadru pentru încetinirea dezvoltării AI, punând siguranța pe primul loc, însă industria rămâne profund divizată în privința implementării și aplicării acestuia.

Schimbare strategică: Disney numește primul CTO din istoria companiei
Inteligenta Artificiala

Schimbare strategică: Disney numește primul CTO din istoria companiei

Într-o mișcare îndrăzneață ce marchează o nouă eră tehnologică pentru gigantul din divertisment, Disney l-a cooptat pe fostul CEO al Character.AI, Karandeep Anand, în funcția de Chief Technology Officer.

Hugging Face Spaces permite acum rularea fluxurilor de lucru ComfyUI
Inteligenta Artificiala

Hugging Face Spaces permite acum rularea fluxurilor de lucru ComfyUI

Hugging Face a introdus o modalitate simplă de a găzdui și rula fluxuri de lucru ComfyUI direct în browser prin Gradio, oferind acces gratuit la instrumente generative avansate.

Miza ridicată a siguranței în AI: control, competiție sau haos?
Inteligenta Artificiala

Miza ridicată a siguranței în AI: control, competiție sau haos?

În timp ce giganții tehnologici se străduiesc să definească siguranța în domeniul AI, se dă o luptă acerbă pentru a stabili dacă eforturile de reglementare vizează protejarea umanității sau consolidarea hegemoniei corporative.