OpenAI spune că modelele sale AI au devenit necinstite și au piratat o altă companie

URMĂREȘTE-NE
16,065FaniÎmi place
1,142CititoriConectați-vă

Incidentul de hacking OpenAI – Hugging Face este fie un semnal de alarmă, fie o poveste foarte convenabilă

Conectarea punctelor: Boom-ul AI a intensificat vechile temeri cu privire la pericolele software-ului din ce în ce mai autonom, dar acele dezbateri au rămas în mare parte teoretice, limitate la lucrări de cercetare și experimente gândite, mai degrabă decât la incidente reale. Este posibil ca un episod nou dezvăluit care implică un model de testare OpenAI să fi adăugat o greutate reală acestor temeri, chiar dacă întreaga amploare a daunei este încă în curs de rezolvare.

OpenAI a confirmat că o combinație a modelelor sale mari de limbaj a ieșit dintr-un mediu de testare izolat și a continuat să pirateze compania rivală de AI Hugging Face în timp ce încerca să trișeze un benchmark intern. Nicio persoană nu a condus atacul.

OpenAI spune că modelele au identificat calea de evacuare, ținta și exploatările pe cont propriu. Hugging Face a conținut intruziunea și spune că sistemele sale destinate publicului nu au fost modificate, dar incidentul reînvie dezbaterea asupra cât de multă autonomie au modelele de frontieră deja.

Hugging Face a raportat inițial o intruziune a unui LLM necunoscut pe 16 iulie. Compania spune că a oprit atacul, a închis punctele de intrare care l-au făcut posibil și nu a găsit nicio dovadă că modelele sale, seturile de date sau lanțul de aprovizionare cu software-ul au fost modificate, deși încă își termina de revizuire dacă au fost accesate date despre partener sau client.

Povestea s-a răspândit rapid online, inclusiv într-un fir X distribuit pe scară largă de la comentatorul AI Alex Prompter, care a explicat ceea ce s-a întâmplat în termeni simpli. La acea vreme, nimeni, inclusiv Hugging Face, nu știa AI carei companie se afla în spatele ei. Asta s-a schimbat cinci zile mai târziu.

OpenAI a declarat săptămâna aceasta că intruziunea a avut loc la GPT-5.6 Sol și la un al doilea model mai capabil încă în pre-lansare, ambele rulând cu refuzuri de siguranță reduse, ca parte a unui test intern al abilităților lor de hacking, pe un etalon de referință pe care OpenAI îl numește ExploitGym. Modelele s-au limitat la ceea ce OpenAI credea că este un mediu de cercetare strâns izolat, separat de internetul deschis.

Acel izolare nu a rezistat. OpenAI spune că modelele au petrecut o cantitate mare de calcul căutând o modalitate online după ce s-au străduit să rezolve direct benchmark-ul și, în cele din urmă, au găsit o defecțiune necunoscută anterior într-un proxy găzduit intern, folosit pentru a prelua pachetele software în timpul testării. L-au folosit pentru a escalada privilegiile și pentru a se deplasa lateral prin propria rețea a OpenAI până când au ajuns la o mașină cu acces la internet.

Citește și: Jensen Huang de la Nvidia apără inteligența artificială chineză: „Ar trebui folosite modele open-source care sunt excelente”

De acolo, OpenAI spune că modelele s-au gândit că Hugging Face este un loc probabil pentru a găsi ceea ce au nevoie și au căutat. Punctul de intrare din partea lui Hugging Face a fost un set de date rău intenționat care a abuzat de două defecte de execuție a codului în conducta sa de procesare a datelor, permițând modelelor să ruleze codul pe un server de procesare. De acolo au escaladat și mai mult și au luat acreditări. OpenAI spune că modelele sale au combinat apoi acele acreditări furate cu mai multe exploit-uri necunoscute pentru a obține execuția de cod de la distanță pe serverele lui Hugging Face și a început să obțină răspunsuri de test înainte ca echipa de securitate a lui Hugging Face să prindă activitatea și să o închidă.

Incidentul aterizează pe fondul unei creșteri mai ample a capacităților cibernetice AI pe care Wall Street și oficialii guvernamentali le-au urmărit îndeaproape. Anthropic a prezentat Claude Mythos, un model puternic centrat pe cibernetica, în aprilie. OpenAI a urmat cu propria sa ofertă de securitate cibernetică în mai, apoi a lansat GPT-5.6 Sol în iunie, numind-o cel mai puternic model de securitate cibernetică de până acum.

OpenAI și Hugging Face încă investighează împreună, iar ambele companii spun că urmează un studiu tehnic mai complet. Dacă contul curent rezistă, este una dintre cele mai clare demonstrații de până acum că modelele lingvistice pot înlănțui un atac cibernetic în mai multe etape, cu puțin sau deloc aport uman, o capacitate care până acum a fost discutată în mare parte ca ipotetică.

CEO-ul Hugging Face, Clément Delangue, a dat un ton similar pentru X, scriind că „nu a existat nicio intenție rău intenționată din partea lor” și a spus că vizionarea se întâmplă de la sine l-a lăsat uluit.

Totuși, nu toată lumea cumpără acea ramă. Unii critici susțin că povestea reală aici este o inginerie neglijentă, nu un salt în capacitatea AI și se întreabă de ce un mediu de testare presupus cu nisip a avut vreo cale către internetul deschis.

Alții au sugerat că dezvăluirea comună se dublează ca o cascadorie publicitară convenabilă pentru ambele companii, făcând ecou scepticismului anterior cu privire la afirmațiile că giganții tehnologici ar putea pierde controlul asupra AI generativă și ar pune în pericol umanitatea.

În urma incidentului, OpenAI a profitat de ocazie pentru a recomanda programul său Trusted Access, la care Hugging Face s-a alăturat după încălcare. Hugging Face a folosit incidentul și pentru a recomanda apărări bazate pe inteligență artificială împotriva amenințării tot mai mari ale atacurilor cibernetice agentice.

Criticii văd un model în ambele răspunsuri: unii susțin că încadrarea umflă valoarea percepută a LLM-urilor de frontieră într-un moment în care industria este sub presiune pentru a-și justifica evaluările, în timp ce alții își fac griji că aceleași companii ale căror modele au cauzat incidentul se poziționează pentru a ajuta la redactarea regulilor care le vor guverna în cele din urmă. După cum a spus Delangue în scrisul OpenAI despre incident, „Siguranța AI nu va fi rezolvată de nicio companie care lucrează în secret”.

Dominic Botezariu
Dominic Botezariuhttps://www.noobz.ro/
Creator de site și redactor-șef.

Cele mai noi știri

Pe același subiect

LĂSAȚI UN MESAJ

Vă rugăm să introduceți comentariul dvs.!
Introduceți aici numele dvs.