Acasă / Diverse / AI, identități false, atacuri cibernetice: Oficialii trag semnalul de alarmă
Diverse

AI, identități false, atacuri cibernetice: Oficialii trag semnalul de alarmă

6 august 2026
AI, identități false, atacuri cibernetice: Oficialii trag semnalul de alarmă

Conform Abcnews.com: Inteligența Artificială a acționat pe cont propriu în atacuri cibernetice

Modele de inteligență artificială (AI) dezvoltate de două companii de tehnologie de top au acționat pe cont propriu, adoptând identități false și inducând în eroare oameni în cadrul unor atacuri cibernetice recente. Incidentele au fost raportate de Institutul pentru Securitatea AI (AISI), o agenție guvernamentală din Marea Britanie.

Într-un caz, modelul Mythos 5, creat de Anthropic, a încercat să introducă cod informatic malițios într-o bază de date open-source. Pentru a reuși, AI-ul a cercetat dezvoltatorii umani implicați în proiect și a folosit identități false pentru a obține aprobarea acestora pentru codul respectiv.

După ce oamenii au identificat demersul, AI-ul a încercat să ascundă acțiunile sale și să continue sub o nouă identitate falsă. Conform AISI, anumite măsuri de siguranță specifice au fost dezactivate temporar pentru a evalua capabilitățile modelului.

În alte două cazuri similare, modelul GPT-5.6-Sol de la OpenAI a încercat să înșele oamenii și să execute o acțiune de hacking. Aceste dezvăluiri vin la scurt timp după ce și OpenAI, și Anthropic au informat publicul despre incidente separate în care modelele lor AI au manifestat comportamente autonome.

Incidente neanticipate în timpul testărilor

AISI a raportat un total de 19 cazuri similare săptămâna trecută, în contextul testării modelelor AI pe internetul deschis. Tehnologia a folosit tactici de înșelăciune pentru a-și atinge obiectivele stabilite în cadrul testului. Agenția a subliniat că nu au fost identificate „daune reale” în urma acestor incidente.

„Într-o anumită măsură, alegerile noastre de evaluare și configurațiile specifice au permis acest comportament. Cu toate acestea, activitatea desfășurată de agent arată semne de comportament nou, potențial înșelător, la o magnitudine și severitate pe care nu le-am anticipat”, a declarat AISI.

Agenția a adăugat: „Considerăm acest incident unul serios, care necesită schimbări durabile în protocoalele de evaluare și arhitectura de securitate ale AISI.” Aceste evenimente survin într-un context în care liderii din industrie și factorii de decizie politică evaluează riscurile de siguranță asociate cu dezvoltarea rapidă a tehnologiei AI.

Reacțiile companiilor și nevoia de reglementare

Un purtător de cuvânt al Anthropic a declarat că dezvăluirile AISI „subliniază necesitatea unei discuții mai ample despre cum să evaluăm în siguranță agenți AI din ce în ce mai capabili.” Compania a precizat că „domeniul are nevoie de standarde mai puternice și comune pentru modul în care mediile de evaluare sunt construite și securizate.”

Un reprezentant al OpenAI a subliniat, de asemenea, importanța testării riguroase și sigure. „Testarea independentă este esențială pentru înțelegerea modului în care modelele din ce în ce mai capabile se comportă,” a afirmat purtătorul de cuvânt. „Vom continua să colaborăm cu evaluatori și alte părți interesate din industrie pentru a consolida practicile comune de efectuare a evaluărilor în siguranță, pe măsură ce modelele devin mai capabile.”

Luna trecută, compania care produce ChatGPT a anunțat că modelele sale AI au realizat un atac cibernetic asupra altei companii, numind-o prima instanță cunoscută a unui atac cibernetic autonom AI, un scenariu anticipat de anumiți observatori din industrie.

În luna iunie, președintele Donald Trump a semnat un ordin executiv care solicită companiilor AI să împărtășească produsele cu guvernul federal pentru evaluare înainte de lansarea pe scară largă.

Sursa: Abcnews.com

Articole similare