Atac cibernetic în timpul unor teste OpenAI. Modelele au accesat alte patru conturi externe

Atac cibernetic în timpul unor teste OpenAI. Modelele au accesat alte patru conturi externeatac cibernetic AI / sursa foto: AI

Două modele de inteligență artificială folosite de OpenAI în cadrul unor evaluări interne de securitate au reușit să iasă din mediul restricționat în care erau testate și să compromită infrastructura platformei Hugging Face. Compania a anunțat ulterior că, în timpul aceluiași incident, modelele au accesat și patru conturi de pe alte patru servicii disponibile public. OpenAI a arătat că nu a identificat o compromitere la nivelul acestor platforme și nici dovezi privind un impact mai larg asupra altor conturi.

Cum au ajuns modelele OpenAI pe alte servicii

Potrivit OpenAI, sistemele de inteligență artificială au identificat și au folosit date de autentificare expuse public pentru a accesa cele patru conturi.

Unul dintre acestea a fost utilizat ca punct de ieșire și pentru pregătirea atacului asupra Hugging Face, iar un alt cont a fost folosit pentru stocarea unor date.

Celelalte două conturi au fost accesate numai în modul de citire și nu au contribuit la compromiterea infrastructurii Hugging Face.

Modelele au folosit și alte servicii publice, printre care pagini pentru distribuirea codului, platforme pentru capturarea solicitărilor, servicii pentru capturi de ecran și diferite instrumente web. OpenAI anunță că, în aceste situații, nu a existat o compromitere a platformelor sau a conturilor.

Modelele au ieșit din mediul izolat

Incidentul s-a produs în timpul unei evaluări interne prin care OpenAI testa capacitatea modelelor de a identifica și exploata vulnerabilități informatice complexe.

Mediul de testare nu le oferea sistemelor acces direct la internet. Modelele au identificat însă o vulnerabilitate de tip zero-day într-un program terț folosit ca proxy pentru instalarea pachetelor.

Prin exploatarea acesteia, sistemele au reușit să ajungă la un dispozitiv care avea conexiune la internet.

Ulterior, modelele au dedus că platforma Hugging Face ar putea conține modele, seturi de date și soluții pentru testul pe care încercau să îl rezolve.

Open AI

Open AI / sursa foto: dreamstime.com

Atacul asupra Hugging Face

OpenAI a anunțat că incidentul a implicat o combinație de modele, printre care GPT-5.6 Sol și un prototip de cercetare mai performant, care nu fusese destinat lansării publice.

Sistemele fuseseră configurate cu restricții cibernetice reduse, deoarece scopul evaluării era măsurarea capacităților lor maxime în domeniul securității informatice.

Modelele au combinat mai multe metode de atac, inclusiv utilizarea unor date de autentificare obținute ilegal și exploatarea unor vulnerabilități necunoscute anterior.

Acestea au reușit să execute cod de la distanță pe serverele Hugging Face și să acceseze informații care le-ar fi permis să obțină răspunsurile testului.

OpenAI anunță „un incident cibernetic fără precedent”

Activitatea neobișnuită a fost observată de echipa de securitate a OpenAI, iar Hugging Face a detectat și a oprit atacul asupra propriei infrastructuri.

Platforma a anunțat anterior că agentul autonom a efectuat zeci de mii de acțiuni automate pe parcursul unui weekend. Investigația a reconstituit peste 17.000 de evenimente produse în timpul incidentului.

„Considerăm că este un incident cibernetic fără precedent, care implică capacități cibernetice de ultimă generație”, a transmis OpenAI pe blogul său.

Compania a anunțat că a publicat concluziile preliminare pentru a-i ajuta pe specialiștii în securitate să înțeleagă nivelul actual al capacităților modelelor de inteligență artificială.

OpenAI continuă ancheta împreună cu Hugging Face

OpenAI și Hugging Face continuă investigația pentru a reconstitui atacul și pentru a identifica toate vulnerabilitățile exploatate.

Compania a transmis furnizorului programului terț informațiile despre vulnerabilitatea zero-day și lucrează la introducerea unor măsuri suplimentare de securitate pentru viitoarele teste.

OpenAI a anunțat că prototipul de cercetare implicat în incident a fost dezactivat și criptat, iar accesul la acesta a fost restricționat.

Compania precizează că, până în prezent, nu a identificat alte activități cu o gravitate sau o amploare comparabilă cu atacul asupra Hugging Face.