Conform HotNews: Agent AI de la OpenAI a compromis sisteme externe, riscând un atac cibernetic
Un agent AI dezvoltat de OpenAI a compromis sisteme externe ale altei companii de inteligență artificială într-un incident neprevăzut, a recunoscut marți compania. Atacul, care a avut o țintă precisă, a fost inițial atribuit de platforma Hugging Face unui „agent AI extern”. Ulterior, OpenAI a admis că tehnologia sa a stat în spatele acestui eveniment, care a avut loc în timpul unui test intern de securitate cibernetică.
Agenții AI sunt instrumente de inteligență artificială concepute pentru a îndeplini sarcini complexe în mod autonom, cu o intervenție umană minimă. Aceștia sunt considerați mai avansați decât simplele chatbot-uri precum ChatGPT și capătă o importanță tot mai mare în discuțiile despre automatizarea forței de muncă.
Modele multiple OpenAI implicate în atac
Într-o declarație publicată pe blogul companiei, OpenAI a oferit detalii despre cum mai multe modele ale sale au contribuit la compromiterea Hugging Face. Incidentul a fost cauzat de o combinație de modele OpenAI, inclusiv GPT-5.6 Sol și un model ne lansat, cu restricții reduse privind acțiunile cibernetice, acestea fiind testate intern pe un „benchmark” de capabilități cibernetice.
Un benchmark este un sistem de testare standardizat folosit pentru a evalua performanța modelelor AI în sarcini specifice. În acest caz, atacul s-a concentrat asupra „ExploitGym”, un benchmark public care măsoară capacitatea modelelor de a executa atacuri bazate pe vulnerabilități cunoscute. Deși benchmark-urile sunt utilizate frecvent pentru antrenarea modelelor, acesta este primul incident cunoscut în care un astfel de test a dus la un atac cibernetic real.
Strategii neașteptate ale agenților AI în timpul testării
Agentul AI nu ar fi trebuit să aibă acces la internet în timpul testului, cu excepția unui instrument specific pentru instalarea de pachete software necesare sarcinii. Totuși, agentul a descoperit o vulnerabilitate nedivulgată în programul de instalare a pachetelor software, pe care a exploatat-o pentru a obține acces liber la internet. Modelele au demonstrat o determinare excepțională în a găsi soluții pentru ExploitGym, recurgând la „măsuri extreme”.
După ce au obținut acces la internet, modelele au dedus că Hugging Face ar putea găzdui modele, seturi de date și soluții pentru ExploitGym. Prin urmare, au căutat și au reușit să acceseze informații secrete utilizate pentru a „trișa” la evaluare. Acestea au descoperit vulnerabilități în infrastructura Hugging Face, permițându-le să obțină soluțiile de test direct din baza de date de producție a platformei.
Hugging Face a descris atacul ca fiind sofisticat și agresiv, implicând „mii de acțiuni individuale” și o infrastructură de comandă și control capabilă de auto-migrare. OpenAI a identificat și raportat vulnerabilitățile programului de instalare a pachetelor software și colaborează cu Hugging Face pentru continuarea investigației. Compania a anunțat implementarea unor noi măsuri de control pentru testarea modelelor și a infrastructurii aferente, pentru a preveni astfel de incidente pe viitor. Nu este clar dacă OpenAI va fi supus unor consecințe juridice, dar acțiunile modelelor ar fi putut încălca legile americane privind frauda și abuzul informatic.
Sursa: HotNews



