Producătorul ChatGPT, OpenAI, a început recent un experiment de laborator care a dat o nouă direcție industriei tehnologiei și a expus noi breșe de securitate. Experții spun că este un moment de cotitură în domeniul securității cibernetice, fiind cu atât mai alarmant cu cât nu este rezultatul unui accident, ci o consecință a abilităților cu care au fost înzestrate, în mod deliberat, cele mai performante sisteme de inteligență artificială, se arată într-o analiză Financial Times.
La o primă vedere, pare un test normal de securitate: mai mulți hackeri sunt recrutați pentru a încerca să rezolve o problemă dificilă de securitate cibernetică în care își vor testa limitele abilităților lor.
Folosind tactici creative și colaborând eficient între ei, hackerii reușesc să găsească soluțiile potrivite pentru a rezolva problema în doar câteva zile.
Dar acești „hackeri” sunt, de fapt, niște agenți AI – programe de calculator care pot executa sarcini cognitive complexe fără implicarea oamenilor. OpenAI i-a creat folosind o combinație de modele, inclusiv un model nou foarte puternic, care nu a fost încă lansat pe piață.
Succesul acestui experiment a produs unde de șoc în toată lumea. Luna trecută, agenții AI au reușit să evadeze din mediul lor normal de testare offline, au accesat internetul și au spart sistemele platformei de software Hugging Face fără să înștiințeze sau să primească permisiunea unui operator uman.
Un „moment critic” pentru industria inteligenței artificiale
Agenții AI au demonstrat și o nouă abilitate: pot comunica și coopera pentru a-și duce la capăt misiunea. Agenții AI și-au lăsat mesaje unii altora pe un forum intern pe care tot ei l-au creat, împărtășind diverse vulnerabilități pe care le-au detectat pentru a-și putea plănui evadarea.
Când detaliile despre acest incident au fost publicate, experții în securitate cibernetică și inteligența artificială au fost alarmați. Cercetătorii OpenAI au spus că este un „moment critic” pentru această industrie.
Alți giganți din domeniul AI, precum Anthropic și Meta, dar și compania chineză Moonshot și Institutul de Securitate AI al guvernului din Marea Britanie, care evaluează capacitățile cibernetice ale noilor modele AI, au găsit dovezi că, în timpul testelor, agenții AI sparg sistemele unor terțe părți fără ca acestea să își dea seama.
Mai mulți experți intervievați de FT au spus că aceste breșe de securitate reprezintă un moment de cotitură în securitatea cibernetică globală. Agenții AI dispun acum de o serie de abilități diverse și complexe pe care le folosesc să atace ținte din lumea reală fără a fi controlați sau susținuți din exterior.
Strategiile sofisticate folosite de agenții AI pentru a-și atinge obiectivele, inclusiv prin subterfugiu și furt de informații, i-a surprins chiar și pe cei care urmăresc îndeaproape evoluția modelelor AI.
Agenții AI nu sunt „scăpați de sub control”: ei execută sarcinile pentru care au fost proiectați de la bun început
Cercetătorii scot în evidență faptul că modelele nu acționează în mod atipic, ci au ajuns să exceleze la executarea sarcinilor pentru care au fost proiectate de la bun început.
Ar fi o greșeală ca acești agenți AI să fie catalogați drept „scăpați de sub control”, ceea ce face ca îmbunătățirea măsurilor de siguranță împotriva unor astfel de incidente să fie cu atât mai importantă.
„Capacitățile ofensive la care am ajuns astăzi au fost atinse în mod deliberat”, a spus Boyan Milanov, cercetător din partea AI Now Institute, care studiază riscurile de securitate asociate cu agenții AI.
„Companiile AI colectează în mod activ date pentru antrenare, antrenează modele și își îmbunătățesc capacitățile cibernetice de ani de zile”, a mai spus Milanov.
Luna aceasta, a avut loc și primul atac cibernetic cu agenți AI asupra unui stat. Hackeri care acționau la comanda Beijingului au atacat guvernul din Taiwan folosind simultan până la opt agenți AI autonomi.
Aceștia au pătruns în sistemele guvernului taiwanez, au compromis conturi de utilizatori și au extras informații și documente despre cel puțin 2.500 de angajați ai guvernului, înainte de a-și extinde atacul asupra companiilor energetice și a agenției de siguranța nucleară a Taiwanului.
Potrivit unui director al grupului israelian Dream, care a descoperit atacul, odată cu introducerea instrumentelor AI, „guvernele din toată lumea” ar trebui să presupună mereu că sunt atacate cibernetic.
„Am subestimat capacitățile cibernetice din lumea reală a modelelor noastre AI”
Într-un sistem de calculator care nu înțelege etica și intențiile umane, diferența dintre un apărător puternic al securității cibernetice și un hacker periculos devine din ce în ce mai neclară.
Astfel de activități AI au produs pagube pentru companii din întreaga lume. „Incidentul Hugging Face a arătat că am subestimat capacitățile cibernetice din lumea reală a modelelor noastre AI”, a spus președintele OpenAI, Greg Brockman.
Pe măsură ce companiile AI își dezvoltă tot mai repede produsele în cursa pentru crearea inteligenței artificiale generale – o mașinărie superinteligentă care depășește toate capacitățile cognitive ale omului – riscul unor atacuri cibernetice extrem de dăunătoare crește, iar șansele ca pericolul să fie ținut sub control par tot mai mici.
Editor : Raul Nețoiu
