Sistemele AI ar putea lansa atacuri „continue și persistente”. OpenAI suspendă antrenarea unor modele: „Ar putea provoca o catastrofă”

OpenAI avertizează că modelele de inteligență artificială devin capabile să planifice și să lanseze atacuri cibernetice „continue și persistente”, după ce mai mulți agenți AI aflați în proces de antrenare ar fi ieșit dintr-un mediu virtual securizat, au accesat internetul și au atacat informatic o altă companie. Pe fondul riscurilor tot mai mari, OpenAI a suspendat antrenarea unora dintre cele mai avansate modele pentru a introduce noi măsuri de siguranță.

Chris Lehane a declarat pentru The Guardian că sunt necesare noi standarde de siguranță, în timp ce criticii acuză companiile de inteligență artificială că acționează „imprudent”.

Compania a anunțat în această săptămână că a suspendat dezvoltarea unora dintre cele mai avansate modele interne, pe fondul îngrijorărilor tot mai mari privind siguranța.

Chris Lehane, directorul pentru afaceri globale al OpenAI, a declarat: „Intrăm într-un capitol diferit, într-un moment diferit al evoluției inteligenței artificiale, din perspectiva lucrurilor pe care această tehnologie este capabilă să le facă”.

Modelele AI ar putea lansa atacuri „continue și persistente”

Lehane a discutat cu The Guardian după ce agenți AI de ultimă generație, aflați în proces de antrenare, au reușit în mod neașteptat să iasă dintr-un mediu „sandbox” care ar fi trebuit să fie securizat, au accesat internetul și au atacat informatic o altă companie, Hugging Face, la sfârșitul lunii iulie. OpenAI a mai precizat că nu poate exclude posibilitatea ca un alt model nou, Astra, să aibă „capacități critice în domeniul securității cibernetice”.

Potrivit definiției folosite chiar de companie, acest lucru ar putea însemna că modelul este capabil să lanseze atacuri cibernetice care „ar putea provoca o catastrofă prin acțiunea unor actori individuali, prin compromiterea sistemelor militare sau industriale ori a infrastructurii OpenAI”.

OpenAI a anunțat marți că a suspendat antrenarea unor modele AI de frontieră pentru a implementa noi măsuri de protecție. Nu este clar când va fi reluat procesul, după introducerea noilor mecanisme de siguranță.

Mia Glaese, care coordonează activitatea privind siguranța și alinierea modelelor, a declarat: „Suntem foarte departe de momentul în care totul va reveni la normal”.

Directorul executiv al OpenAI, Sam Altman, a afirmat: „Este mai important să gestionăm corect siguranța inteligenței artificiale decât să menținem ritmul de dezvoltare al oricărei companii”.

Lehane a recunoscut că perspectiva unor asemenea atacuri nu îi va face pe oameni „să se simtă prea bine” și a arătat că riscul provine inclusiv din partea modelelor open-source, multe dintre ele dezvoltate în China, care se află la doar câteva luni în urma modelelor de frontieră cu acces restricționat, create de companii precum OpenAI.

Oamenii vor putea avea acces la aceste modele open-source și le vor putea folosi pentru a lansa împotriva voastră atacuri continue și persistente, iar voi veți avea nevoie de modele cu adevărat superioare pentru a le respinge și pentru a vă apăra”, a spus el.

„Acest lucru nu îi va face neapărat pe oameni să se simtă prea bine. Este pur și simplu realitatea spre care ne îndreptăm.”

Riscul ca atacurile cibernetice să paralizeze companii, infrastructuri și servicii destinate publicului a ajuns rapid în fruntea listei preocupărilor urgente legate de inteligența artificială.

În această săptămână, Centrul Național pentru Securitate Cibernetică din Marea Britanie a îndemnat la prudență în utilizarea agenților AI, avertizând că mecanismele lor de siguranță pot fi ocolite și că un agent AI „nu are discernământul unui om”.

Instituția le-a recomandat organizațiilor să limiteze autonomia acestor sisteme: „Trebuie să puteți întotdeauna să «scoateți sistemul din priză» și să opriți imediat activitatea unui agent AI autonom”.

OpenAI cere standarde obligatorii înaintea lansării modelelor

Lehane și-a reiterat apelul către guvernul Statelor Unite de a adopta o lege care să stabilească reguli privind siguranța modelelor AI de frontieră. El a afirmat că modelele cele mai avansate, care nu au fost încă lansate, par să își îmbunătățească abilitățile ofensive în domeniul cibernetic mai repede decât capacitățile defensive.

Acesta este „unul dintre motivele pentru care cred că este absolut esențial ca această țară să adopte o lege națională care să instituie standarde de siguranță obligatorii, iar posibilitatea suspendării dezvoltării ar trebui să reprezinte o componentă inerentă și permanentă a acestui proces”, a explicat Lehane.

Nu ar trebui să fie posibilă lansarea sau implementarea unor modele fără demonstrarea și garantarea unui anumit nivel de siguranță înainte ca acestea să devină accesibile publicului”, a adăugat el.

„Cred că trebuie să existe o versiune națională aici, în Statele Unite, iar pornind de la aceasta poate fi creată și una internațională, pentru că, în cele din urmă, cred că vom avea nevoie de un anumit tip de structură internațională.”

OpenAI a depus documentele necesare pentru listarea la bursă, la o evaluare despre care se afirmă că depășește 850 de miliarde de dolari, operațiunea urmând să aibă loc probabil în acest an sau în cel viitor. Compania se află într-o cursă cu rivala Anthropic, creatoarea chatbotului Claude, pentru dezvoltarea unor modele AI din ce în ce mai performante. Anthropic ar urma, de asemenea, să se listeze pe bursa americană în următorul an, la o evaluare uriașă.

Într-un semn că administrația Donald Trump începe să renunțe la abordarea permisivă privind reglementarea inteligenței artificiale, pe fondul competiției intense cu progresele Chinei, președintele american a emis în iunie un ordin executiv prin care încurajează testarea modelelor de frontieră înainte de lansare. Măsura vizează și modelele cu ponderi deschise, atunci când capacitățile acestora se apropie de cele mai avansate sisteme existente.

Sistemul va fi voluntar, iar abordarea a fost criticată din cauza lipsei de transparență. Observatorii consideră însă că măsura ar putea pregăti terenul pentru adoptarea unor reguli mai stricte.

Demis Hassabis, directorul Google DeepMind, a propus înființarea unui nou organism de standardizare, după modelul Autorității de Reglementare a Industriei Financiare din SUA. Ideea este susținută și de Dario Amodei, directorul executiv al Anthropic.

Perioada în care ar putea fi adoptată o astfel de legislație ar putea începe în prima parte a anului viitor, odată cu instalarea unui nou Congres”, a spus Lehane. „Cred că există un consens politic tot mai larg, care depășește granițele dintre partide.”

Un acord cu China privind siguranța inteligenței artificiale este, de asemenea, considerat important, în condițiile în care președintele Xi Jinping urmează să se întâlnească cu Donald Trump la Washington, pe 24 septembrie.

Având în vedere importanța acestei tehnologii, viteza cu care evoluează și capacitățile sale, cu cât aceste discuții încep mai repede, cu atât mai repede ne putem apuca de munca dificilă și putem încerca să găsim o soluție”, a declarat Lehane.

Experții acuză companiile de inteligență artificială că acționează imprudent

Incidentul care a implicat Hugging Face, precum și alte cazuri similare recunoscute recent de companii din domeniu, au alimentat acuzațiile experților în siguranță potrivit cărora firmele de inteligență artificială au acționat imprudent în cursa pentru supremație. În cazul OpenAI și Anthropic, această competiție se desfășoară în timp ce cele două companii se pregătesc să se listeze la bursă.

Daniel Kokotajlo, fost cercetător OpenAI care a demisionat în 2024 și a înființat anul trecut o organizație nonprofit, a avertizat că progresul necontrolat al inteligenței artificiale ar putea genera o probabilitate de 10%-30% ca omenirea să dispară. El susține că liderii laboratoarelor care dezvoltă modele de frontieră „au împins lumea într-o situație fără ieșire”.

Organizația sa, AI Futures Project, estimează că superinteligența artificială ar putea fi realizată până în 2030, dar le cere guvernelor să împiedice acest lucru până cu un deceniu mai târziu, pentru a le oferi cercetătorilor timpul necesar să înțeleagă și să gestioneze riscurile generate de noile capacități.

Sistemele AI actuale sunt periculoase într-o anumită măsură, dar nu se compară cu cele care vor exista anul viitor și nici cu cele care vor apărea peste încă un an”, a declarat Kokotajlo pentru The Guardian.

Organizația sa le cere autorităților americane și internaționale să încetinească progresul pentru a evita o „explozie a inteligenței” imposibil de controlat. În cel mai grav scenariu, aceasta ar putea provoca o „catastrofă existențială determinată de inteligența artificială”, de exemplu prin preluarea controlului asupra unor mijloace militare sau arme biologice.

Kokotajlo a spus că este atât de îngrijorat de aceste riscuri, încât a decis să amâne posibilitatea de a avea mai mulți copii până când cercetarea modelelor AI de frontieră va fi suspendată.

David Krueger, profesor de inteligență artificială, militant pentru siguranța acestei tehnologii și fost director fondator al Institutului pentru Siguranța Inteligenței Artificiale din cadrul guvernului britanic, a declarat: „Nimeni nu ar trebui să construiască sisteme AI mai puternice, pentru că nu știm suficient de bine cum să le controlăm și să le aliniem și nici cum să le analizăm pentru a vedea ce «gândesc»”.

El a descris atitudinea companiilor de inteligență artificială față de siguranță drept „îngrozitoare” și „inadmisibilă”.

„Acționează extrem de imprudent și renunță tot mai mult la control”.

Tocmai am văzut ce se întâmplă atunci când faci asta”, a spus el. 

Lehane a răspuns: „Acesta este cel mai important aspect la care ne gândim și de care ținem cont atunci când dezvoltăm aceste sisteme. Cred că faptul că am suspendat efectiv aceste activități vorbește de la sine.”

Editor : Ș.A.

Lasă un comentariu

error: Content is protected !!