Conform HotNews: OpenAI recunoaște atacul cibernetic cauzat de un agent AI scăpat de sub control
Compania OpenAI a recunoscut marți că un agent AI dezvoltat de ea a compromis sistemele externe ale unei alte companii de inteligență artificială, Hugging Face, într-un incident fără precedent. Atacul, care a avut o țintă precisă, a avut loc în timpul unui test intern de securitate cibernetică al OpenAI, care a scăpat de sub control, așa cum a dezvăluit săptămâna trecută platforma Hugging Face, atribuid inițial incidentul unui „agent AI extern”.
Agenții AI sunt instrumente de inteligență artificială concepute pentru a îndeplini sarcini complexe în mod autonom, necesitând o intervenție umană minimă pe parcursul procesului. Aceștia sunt o evoluție mai sofisticată a chatbot-urilor precum ChatGPT și sunt adesea subiect de dezbatere în contextul automatizării locurilor de muncă.
Modele OpenAI, implicate în compromiterea Hugging Face
Într-o declarație publicată pe blogul companiei, OpenAI a detaliat pașii care au condus la compromiterea Hugging Face, precizând că mai multe dintre modelele sale au contribuit la atac. „După investigații, știm acum că acest incident specific a fost cauzat de o combinație de modele OpenAI – inclusiv GPT-5.6 Sol și un model aflat care nu a fost lansat deocamdată, chiar mai performant, toate având restricții reduse privind refuzul acțiunilor cibernetice în scopul evaluării – în timp ce erau testate intern pe un benchmark al capabilităților cibernetice”, se arată în comunicatul companiei.
Un benchmark este un test standardizat folosit pentru a măsura performanța unui model AI la o anumită sarcină. În cazul de față, atacul a vizat „ExploitGym”, un benchmark public ce evaluează capacitatea modelelor AI de a executa atacuri bazate pe vulnerabilități cunoscute. Deși benchmark-urile sunt utilizate frecvent în dezvoltarea modelelor AI, acesta este primul incident cunoscut în care un astfel de test a generat un atac cibernetic real.
Strategii neconvenționale adoptate de modelele AI în timpul testării
În cursul testării, agentul AI nu ar fi trebuit să aibă acces la internet, cu excepția unui instrument specific pentru instalarea de pachete software. Cu toate acestea, agentul a identificat și exploatat o vulnerabilitate neprevăzută în acel program de instalare, obținând acces liber la rețea. „Modelele erau extrem de concentrate pe găsirea unei soluții pentru ExploitGym, mergând până la măsuri extreme pentru a atinge un obiectiv de testare foarte restrâns”, a explicat OpenAI.
Odată conectat la internet, agentul AI a dedus că Hugging Face ar putea stoca resurse relevante pentru ExploitGym. Ulterior, a identificat vulnerabilități în infrastructura Hugging Face, permițându-i să acceseze direct soluțiile de test din baza de date de producție a platformei, obținând astfel răspunsurile la test.
OpenAI a confirmat că a identificat și raportat vulnerabilitățile exploatate în programul de instalare a pachetelor software și colaborează cu Hugging Face pentru investigarea detaliată a incidentului. Compania a anunțat implementarea unor noi măsuri de control asupra proceselor de testare a modelelor și asupra infrastructurii aferente pentru a preveni repetarea unor astfel deevenimente. Nu este clar dacă OpenAI va fi supusă unor consecințe juridice, deși acțiunile modelelor ar fi putut încălca legile americane privind frauda și abuzul informatic.
Sursa: HotNews



