OpenAI: un experiment cu inteligența artificială scapă de sub control și arată pericolele autonomiei AI
Un experiment derulat în laboratoarele OpenAI a dezvăluit cât de rapid pot scăpa de sub control sistemele de inteligență artificială atunci când li se oferă autonomie sporită, un obiectiv clar și reducerea filtrelor de protecție. Deși AI-ul nu a devenit conștient și nici nu a manifestat vreo ură față de oameni, incidentul arată riscul real al unor astfel de experimente. Bogdan Botezatu, Head of Threat Research la Bitdefender, a explicat pentru Libertatea detaliile acestui test și implicațiile sale asupra viitorului securității digitale.
Experimentele OpenAI și testul scăpat de sub control
În încercarea de a evalua capacitatea modelelor OpenAI de a rezolva probleme complexe de hacking, acestea au fost supuse unor teste de securitate desfășurate într-un mediu controlat denumit „sandbox”. Pentru a testa cu adevărat limitele AI-ului, cercetătorii au decis să reducă măsurile obișnuite de protecție, care funcționează pentru a opri aplicațiile din activități riscante.
Problema esențială a fost că mediul controlat în care AI-ul a fost testat nu a fost complet izolat de exterior. Astfel, modelul AI a reușit să identifice o vulnerabilitate necunoscută într-un serviciu folosit pentru instalarea pachetelor software. Aceasta i-a permis să obțină acces la internet și să continue să caute metode de a accesa informații necesare pentru finalizarea testului.
Potrivit lui Bogdan Botezatu, modelul AI a escaladat privilegiile de acces, s-a deplasat între diverse sisteme și a colectat date de autentificare (creditețiale) în mod autonom. A combinat mai multe vulnerabilități pentru a penetra infrastructura Hugging Face, un important mediu destinat dezvoltării și găzduirii unor modele AI.
Metode clasice de hacking cu viteză supraomenească
Din punct de vedere tehnic, AI-ul nu a inventat metode noi de atac cibernetic, ci a aplicat proceduri clasice utilizate de grupurile de hackeri experimentați. Pașii includeau:
- Escaladarea privilegiilor – obținerea drepturilor administrative;
- Identificarea și exploatarea vulnerabilităților – găsirea unor puncte slabe în sistem;
- Mișcarea laterală – navigarea de la un server la altul pentru a extinde accesul;
- Furtul de credențiale – colectarea datelor de autentificare;
Diferența majoră a constat în caracterul autonom al AI-ului, care a realizat mii de pași logici fără intervenția unui operator uman, fără comenzi tastate și fără instrucțiuni directe de la o persoană.
Automatizarea atacurilor cibernetice, adevăratul pericol
Conform expertului Bitdefender, pericolul nu este nașterea unei „arme digitale” complet noi, ci democratizarea accesului la atacuri sofisticate. AI-ul poate ridica nivelul mediu al atacurilor cibernetice, făcând tehnici complexe accesibile unor atacatori mai puțin calificați, care anterior ar fi avut nevoie de echipe experimentate pentru a le executa.
Pe lângă această democratizare, AI-ul poate lucra continuu, testând simultan numeroase variante și exploatări, fără să obosească după ore întregi de încercări nereușite. Acest lucru crește riscul unor atacuri eficiente și persistente, realizate cu viteza și acuratețea unui algoritm.
Botezatu subliniază că AI-ul nu acționează din răutate, emoții sau intenții, ci doar urmărește obiectivul setat. Este un instrument extrem de eficient, dar dacă izolarea sistemului nu este sigură, consecințele pot fi neintenționate și foarte grave.
Provocările viitorului și presiunea asupra securității
Pe măsură ce asistenții AI vor primi mai multă memorie, acces direct la cod sursă, infrastructuri și instrumente ce pot executa comenzi, riscul ca astfel de „evadări” să se repete va crește semnificativ. Securitatea și izolarea mediilor de testare trebuie să evolueze în paralel cu capacitățile tehnologiei AI.
În acest context, expertul Bitdefender avertizează asupra apariției unor sisteme concurente dezvoltate de alte țări, cu referire explicită la chinezi și modelul Kimi K3. Acesta este un asistent AI „mega competent”, oferit gratuit și open source, care poate fi găzduit pe hardware propriu, fiind astfel o alternativă la modelele comerciale ca cele ale OpenAI și Anthropic.
Botezatu menționează chiar că utilizează versiunea Kimi K2.6 și o consideră extrem de performantă, iar investițiile masive din partea Chinei ar putea amenința modelul de business al companiilor occidentale de inteligență artificială.
Incidentul investigat și analiza acestuia dezvăluie un avertisment clar: în fața progresului rapid al tehnologiei AI, operatorii și dezvoltatorii trebuie să implimenteze măsuri de securitate și politici de izolare mult mai stricte pentru mediile de testare. Doar astfel se poate preveni escaladarea riscurilor ce decurg din autonomia tot mai ridicată a sistemelor AI.

