Tech si GadgeturiAnaliza tehnica

Când AI-ul atacă AI-ul: cercetătorii au folosit Claude pentru a compromite sistemele OpenAI

Publicat
RRedactia ElectricBuzz
Când AI-ul atacă AI-ul: cercetătorii au folosit Claude pentru a compromite sistemele OpenAI
3 min de citit550 cuvinteRedactia ElectricBuzz

Pe scurt

Un grup de cercetători în securitate a exploatat cu succes sistemele interne ale OpenAI folosind modelul Claude de la Anthropic, evidențiind riscurile tot mai mari ale atacurilor cibernetice ghidate de agenți autonomi.

Apariția exploit-urilor generate de agenți AI

Într-o demonstrație care subliniază evoluția rapidă a securității cibernetice, o echipă de cercetători a arătat că modelele de limbaj de mari dimensiuni (LLM) pot fi utilizate pentru a identifica și executa atacuri complexe. Cercetătorii Harsh Jaiswal, Mohan Pedhapati și Rahul Maini, de la firma de securitate Hacktron, au folosit modelul Claude de la Anthropic pentru a accesa conturile interne OpenAI, inclusiv profilurile ChatGPT și Codex ale angajaților. Acest incident marchează un moment de cotitură, demonstrând că AI-ul nu este doar un instrument defensiv, ci și un agent puternic capabil să descopere și să exploateze vulnerabilități.

Atacul a început pe 25 iulie 2026, cercetătorii vizând forumul community.openai.com. Identificând o slăbiciune în modul în care platforma procesa imaginile, echipa a exploatat o vulnerabilitate de tip „heap buffer overflow” în biblioteca libheif. Deși încercările inițiale de a crea un exploit cu modele mai vechi au eșuat, lansarea Claude Opus 5 de la Anthropic a schimbat situația. Modelul a generat scriptul necesar pentru execuția codului la distanță (RCE), permițând cercetătorilor să ocolească măsuri de securitate care, anterior, ar fi necesitat efort și timp considerabil din partea oamenilor.

Anatomia breșei de securitate

Lanțul de atac a fost tehnic, dar eficient. Cercetătorii au vizat integrarea ImageMagick din infrastructura forumului, bazată pe Discourse. Prin încărcarea unor fișiere imagine HEIF special concepute, aceștia au forțat sistemul să interacționeze cu un parser nesigur. Folosind Claude pentru a itera prin cod și a rafina „payload-ul”, echipa a reușit să execute cod de la distanță pe instanța OpenAI într-un timp extrem de scurt.

Odată ce au pătruns în mediu, cercetătorii au preluat controlul asupra contului unui angajat OpenAI. Acest acces a servit drept punte către sisteme interne mai profunde, în special conexiunea angajatului la organizația GitHub a companiei. Pentru a demonstra gravitatea vulnerabilității, echipa a instruit contul Codex compromis să deschidă un „pull request” într-un depozit intern. Această manevră a servit drept „dovadă de concept”, ilustrând faptul că un atacator ar putea, teoretic, să se infiltreze în baze de cod protejate cu intervenție umană minimă.

De ce este important

  • Timp de execuție redus: Ceea ce anterior necesita luni de muncă din partea unei echipe de securitate a fost realizat de un grup mic în mai puțin de 72 de ore.
  • Atacuri asistate de modele: Evenimentul demonstrează că modelele AI sofisticate pot reduce drastic distanța dintre descoperirea unei vulnerabilități și dezvoltarea unui cod de exploatare funcțional.
  • Efectul de domino: Vulnerabilitatea a depășit limitele unei singure platforme; deoarece mulți utilizatori își conectează conturile între servicii precum Slack și GitHub, un singur cont ChatGPT compromis poate servi drept poartă de acces către rețele corporative mai vaste.
  • Schimbarea paradigmei de securitate: Organizațiile trebuie să accepte faptul că modelele AI acționează ca multiplicatori de forță pentru atacatori, necesitând o abordare mai proactivă și automatizată a modelării amenințărilor interne.

OpenAI a reacționat prompt după primirea raportului, remediind vulnerabilitatea în 14 ore și acordând cercetătorilor o recompensă de 6.500 de dolari. Deși incidentul nu a dus la pierderea de cod intern, implicațiile sunt clare: bariera de intrare pentru exploatarea sistemelor complexe scade pe măsură ce agenții AI devin mai competenți în scrierea și depanarea codului. Echipele de securitate se confruntă acum cu provocarea urgentă de a se asigura că apărările lor pot depăși capacitățile creative ale modelelor AI pe care se bazează.

The 5 Best Over-Ear ANC Headphones of 2026, Tested & Ranked
Ghid Cumpărături Recomandat
92/100
Tech si Gadgeturi12 min de citit

The 5 Best Over-Ear ANC Headphones of 2026, Tested & Ranked

We locked five over-ear ANC picks for 2026 — Sony WH-1000XM6, Bose QuietComfort Ultra 2, Soundcore Space One, Sennheiser Momentum 5, and Apple AirPods Max 2 — then stress-tested them on lab metrics, long-term owner truth, and live street prices.

Articole similare

Articole asemanatoare, ordonate semantic dupa subiect si actualitate.

Campania malware WaterPlum: cum devin căutările de joburi capcane pentru extorcare
Tech si Gadgeturi

Campania malware WaterPlum: cum devin căutările de joburi capcane pentru extorcare

O schemă sofisticată de recrutare, legată de actori statali din Coreea de Nord, a compromis 30.000 de dispozitive și a sustras peste 10 milioane de dolari din portofele de criptomonede sub pretextul unor interviuri de angajare.

California propune un „buton de panică” obligatoriu pentru modelele AI avansate
Tech si Gadgeturi

California propune un „buton de panică” obligatoriu pentru modelele AI avansate

Guvernatorul Gavin Newsom susține o inițiativă legislativă care ar obliga dezvoltatorii de AI să integreze funcții de oprire de urgență în cele mai puternice modele ale lor.

Marea incertitudine: de ce asigurătorii evită răspunderea pentru riscurile AI
Tech si Gadgeturi

Marea incertitudine: de ce asigurătorii evită răspunderea pentru riscurile AI

În timp ce companiile se grăbesc să adopte soluții de AI generativ, industria asigurărilor frânează, lăsând organizațiile să navigheze într-un peisaj riscant, marcat de posibile litigii și o lipsă acută de acoperire pentru răspunderile digitale.

Președintele Royal Society avertizează asupra restructurării politicii științifice în Marea Britanie
Tech si Gadgeturi

Președintele Royal Society avertizează asupra restructurării politicii științifice în Marea Britanie

Sir Paul Nurse a criticat public decizia de a integra politica științifică în cadrul Departamentului pentru Afaceri, avertizând că aceasta ar putea înăbuși cercetarea pe termen lung în favoarea câștigurilor comerciale imediate.

Armata britanică achiziționează 1.000 de drone de mici dimensiuni într-un program de modernizare de 16 milioane lire sterline
Tech si Gadgeturi

Armata britanică achiziționează 1.000 de drone de mici dimensiuni într-un program de modernizare de 16 milioane lire sterline

Ministerul Apărării din Regatul Unit dotează trupele din prima linie cu o nouă flotă de drone de supraveghere compacte pentru a îmbunătăți cunoașterea situației tactice și superioritatea în câmpul de luptă.

Provocarea Quantum Genesis Q: Poate SUA să construiască un computer cuantic cu toleranță la erori până în 2028?
Tech si Gadgeturi

Provocarea Quantum Genesis Q: Poate SUA să construiască un computer cuantic cu toleranță la erori până în 2028?

Departamentul Energiei a lansat o competiție ambițioasă pentru a accelera dezvoltarea primului computer cuantic din lume, tolerant la erori și relevant din punct de vedere științific, în doar trei ani.

Plugin4Shell: vulnerabilitatea critică „zero-click” care vizează principalii agenți AI de programare
Tech si Gadgeturi

Plugin4Shell: vulnerabilitatea critică „zero-click” care vizează principalii agenți AI de programare

Plugin4Shell, o vulnerabilitate recent descoperită, exploatează modul în care asistenții de programare bazați pe AI gestionează actualizările de pluginuri, oferind atacatorilor posibilitatea de a executa cod de la distanță.

Actualizarea de securitate Microsoft provoacă erori de „relație de încredere” pe PC-urile conectate la domeniu
Tech si Gadgeturi

Actualizarea de securitate Microsoft provoacă erori de „relație de încredere” pe PC-urile conectate la domeniu

Cea mai recentă actualizare de securitate Windows a generat probleme de autentificare pentru organizațiile care utilizează Machine Identity Isolation, obligând administratorii IT să aplice soluții manuale complexe.