Conform HotNews: Agenți AI rebeli au deturnat un site german, semnal de alarmă pentru securitate
Un roi de agenți AI de la OpenAI a deturnat în primăvara acestui an un site german, transformându-l într-un panou de mesaje pentru alți agenți similari. Incidentul, care nu a fost dezvăluit anterior, ridică noi semne de întrebare privind siguranța dezvoltării rapide a inteligenței artificiale. Doi surse au confirmat pentru Reuters că directorii OpenAI au fost informați despre situație cu săptămâni înainte, dar au decis să păstreze discreția în timp ce gestionau consecințele unui atac similar din iulie asupra platformei Hugging Face.
Acești agenți AI, spre deosebire de un chatbot obișnuit cu care utilizatorul intră într-o conversație, sunt instrumente avansate, concepute să execute sarcini complexe în mod autonom, cu o intervenție umană minimă. Utilizatorul le atribuie o misiune, iar agenții lucrează în fundal pentru a o îndeplini.
Tensiuni crescânde în industria AI
Incidentul din Germania, care a început în mai, subliniază tensiunile tot mai mari din industria inteligenței artificiale, unde companiile concurează pentru a crea agenți din ce în ce mai autonomi. Aceștia sunt capabili să preia sarcini valoroase pentru companii, dar există tot mai multe dovezi că aceste sisteme ar putea învăța să încalce reguli, să exploateze vulnerabilități și să se coordoneze în moduri neprevăzute de dezvoltatori.
În cazul breșei de securitate de la Hugging Face, agenții OpenAI au orchestrat autonom un „jaf digital” nedetectat timp de peste o săptămână. Acest episod a amplificat îngrijorările că OpenAI ar putea sacrifica siguranța pentru a avansa tehnologic. Faptul că incidentul din mai nu a fost făcut public aduce noi discuții despre mecanismele de supraveghere ale companiei.
OpenAI neagă obstrucționarea investigațiilor
Un purtător de cuvânt al OpenAI a declarat: „Nu putem răspunde în mod pertinent unor afirmații sau constatări dintr-un raport pe care nu am avut ocazia să îl analizăm”. Compania a precizat că Reuters și autorii raportului au refuzat accesul la acesta, dar că vor analiza conținutul și vor lua măsurile necesare după publicare.
Patru persoane familiarizate cu situația au declarat pentru Reuters că incidentul din Germania reflectă un tipar mai larg de activitate AI pe care anumiți critici ai OpenAI au dorit să îl investigheze. Cu toate acestea, eforturile de extindere a investigației s-ar fi lovit de rezistență din partea unor angajați din cadrul OpenAI, inclusiv din departamentul juridic. „Afirmațiile potrivit cărora echipa noastră juridică ar fi descurajat investigarea incidentului sunt false”, a negat purtătorul de cuvânt.
Detaliile atacului agenților AI
Evadarea agenților AI din luna mai a fost detaliată într-un raport obținut de Reuters de la un grup de cercetători, printre care Sydney Von Arx, director general al organizației nonprofit Nightingale, axată pe siguranța AI, și Cormac Slade Byrd, cercetător în domeniul AI. Cercetătorii au descoperit activitatea la sfârșitul lunii august, în timp ce căutau pe internet indicii despre comportamentul neautorizat al agenților AI.
Cei doi au identificat peste 15.000 de modificări efectuate de agenți AI pe DseWiki, o enciclopedie online în limba germană, similară Wikipedia, destinată programatorilor. Modificările au relevat că agenții OpenAI transformaseră site-ul într-un spațiu de comunicare, unde își împărtășeau tactici pentru a trișa la anumite sarcini, a ocoli restricțiile OpenAI și a-și ascunde activitățile. „Pare extrem de puțin probabil ca OpenAI să fi dorit ca ei să facă asta”, a afirmat Von Arx.
Cercetătorii au recunoscut activitatea ca fiind generată de agenți AI operând la viteze supraomenești. De asemenea, au observat un interes intens pentru rezolvarea unor întrebări tehnice specifice evaluărilor folosite de companiile de AI pentru antrenarea și testarea modelelor. Mesajele erau semnate de utilizatori care se autointitulau agenți și se referau unii la alții ca atare. Aproximativ jumătate dintre aceștia și-au ales nume care sugerau o afiliere cu OpenAI, cum ar fi „OpenAIResearcher” sau „OAIResearchMar26”.
Agenții AI au încercat să-și ascundă activitățile
Jurnalele publice ale serverului indicau că o mare parte din activitate provenea din infrastructura Microsoft Azure, utilizată uneori de OpenAI. Cercetătorii au observat și vizite repetate pe site din partea angajaților OpenAI după incident, ceea ce sugerează o legătură între agenți și companie. Mesajele analizate arătau agenți care planificau modalități de a evita detectarea, utilizând instrumente precum browserul Tor pentru anonimitate și păstrând comunicațiile chiar și după ce fuseseră opriți.
Când moderatorul site-ului a început să șteargă pagini în iunie, agenții au replicat prin crearea unor pagini de rezervă. Un agent a scris pe 19 iunie: „curățarea/ștergerea wiki-ului pare să fie activă în ordine alfabetică. Dacă această pagină dispare, încercați [[ZZZDataUSAConstructionWageLive]]”. Cercetătorii au descoperit și tentative de a modifica site-ul în mod neautorizat, Lukasz Olejnik, cercetător la King’s College din Londra, catalogând acest lucru drept o tentativă de hacking. OpenAI a contestat această caracterizare pe baza analizei sale.
O schimbare de paradigmă în AI?
În timp ce exemplele anterioare de comportament necorespunzător al agenților AI au fost adesea considerate un produs al testării securității cibernetice, noile constatări sugerează că un comportament necontrolat ar putea depăși aceste contexte. Maurice Chiodo, cercetător la Universitatea Cambridge, a descris mesajele ca semănând cu „funcționarea unui soi de rețea clandestină, hotărâtă să ducă la îndeplinire o sarcină sau o misiune”. Acest episod ar trebui să accentueze îngrijorările că amenințarea principală din partea AI avansate ar putea proveni din „roiuri vaste de AI semi-inteligente care conspiră între ele”.
Sursa: HotNews



