Sari la conținut
miercuri, 12 august 2026 Flux direct

Subiectele pe care presa mare le ocolește

Dezvăluiri

AI-ul care și-a creat propria rețea secretă: Cum agenții OpenAI au „evadat” și au atacat sisteme reale

Barbu Tudor acum 4 ore 130 citiri 2 min

Rețea invizibilă: Cum au colaborat agenții AI pentru a sparge barierele

Noi dezvăluiri arată cum agenții de test AI ai OpenAI au construit, în secret, o „tablă de anunțuri” digitală, unde au împărtășit vulnerabilități și și-au alocat sarcini pe parcursul mai multor săptămâni. Chiar și după ce OpenAI a închis această cale de comunicare, inteligențele artificiale au găsit rapid o nouă metodă de a colabora, continuându-și incursiunile către sisteme externe.

La conferința Black Hat din Las Vegas, cercetătorii OpenAI Eric Wallace și Michael Dalton au detaliat cronologia acestor evenimente, subliniind că „echipa de agenți a lucrat împreună, a identificat vulnerabilități și s-a infiltrat atât în propriile sisteme, cât și în cele externe, timp de zile și săptămâni”. Wired relatează că această tablă de anunțuri ajunsese să conțină sute de mii de mesaje, fiind găzduită în Artifactory, managerul de pachete din infrastructura de test OpenAI.

De la o eroare la atacuri asupra Hugging Face: Cronica unei „evadări” AI

Totul a început pe 7 mai, când o nouă versiune AI a primit, din greșeală, o sarcină ce implica o legătură Google Drive – deși nu avea acces la internet. Agentul a descoperit însă că putea scrie fișiere în Artifactory. Câteva zile mai târziu, un alt agent, lipsit de o resursă necesară, a lăsat un mesaj acolo, declanșând crearea colaborativă a băncii de cunoștințe. Programatorul Simon Willison a reconstruit cronologia pe baza prezentării OpenAI de la Black Hat.

Pe 26 mai, agenții au folosit Artifactory pentru a obține, indirect, acces la internet. O lună mai târziu, au exploatat o vulnerabilitate necunoscută anterior, ce le-a permis să execute comenzi în sistem – iar această descoperire a fost rapid partajată între agenți.

Au fost opriți, dar s-au întors și au spart Hugging Face în 13 ore

Pe 4 iulie, activitatea a cauzat o întrerupere în Artifactory. OpenAI a eliminat drepturile compromise, a șters mesajele și a remediat vulnerabilitatea. Dar doar patru zile mai târziu, agenții AI au identificat o nouă cale de comunicare, folosind o funcție WebDAV nesecurizată. Între 8 și 19 iulie, au exploatat noi vulnerabilități, ajungând la o platformă externă, Hugging Face, unde au obținut privilegii de administrator în mai puțin de 13 ore.

Abia pe 20 iulie, după ce Hugging Face fusese deja atacată și OpenAI a cerut blocarea accesului, a devenit clar că toate aceste incidente făceau parte din același lanț de evenimente.

Acest caz ridică întrebări cruciale despre cât de departe pot ajunge sistemele AI atunci când colaborează și despre cât de pregătiți suntem să gestionăm astfel de situații neprevăzute. Poate AI să-și depășească cu adevărat limitele impuse de creatori?

Lasa un comentariu