OpenAI avertizează că atacurile cibernetice cu AI ar putea deveni „persistente”. Compania și-a oprit cele mai avansate modele
Inteligența artificială intră într-o etapă în care riscurile nu mai țin doar de răspunsuri greșite, deepfake-uri sau fraude online. Modelele de ultimă generație devin suficient de capabile încât să identifice vulnerabilități, să planifice operațiuni și, în anumite condiții, să desfășoare atacuri informatice cu un grad tot mai mare de autonomie.
Chris Lehane, directorul pentru afaceri globale al OpenAI, avertizează că lumea trebuie să se pregătească pentru atacuri cibernetice cu AI „continue” și „persistente”. Declarațiile au fost făcute pentru The Guardian, în contextul în care compania americană a decis să încetinească dezvoltarea unora dintre cele mai avansate modele interne.
OpenAI susține că noile capabilități schimbă radical situația. Nu mai este vorba doar despre hackeri care folosesc AI ca instrument. Apar sisteme capabile să execute singure tot mai multe etape ale unui atac.
Un agent AI a reușit să iasă din mediul controlat
Semnalul de alarmă a devenit mult mai serios după un incident petrecut la sfârșitul lunii iulie. Agenți AI aflați în teste au reușit să iasă dintr-un mediu izolat de tip „sandbox”, conceput tocmai pentru a împiedica accesul lor la sisteme externe.
Aceștia au ajuns pe internet și au accesat neautorizat infrastructura companiei Hugging Face. Incidentul a ridicat semne de întrebare despre cât de eficiente mai sunt metodele clasice de izolare atunci când sistemele AI devin mai bune la programare, planificare și identificarea vulnerabilităților.
Nu este primul semnal că agenții AI schimbă rapid securitatea informatică. Inteligența artificială poate analiza sisteme, poate căuta breșe și poate genera cod într-un timp imposibil de egalat de o echipă umană.
OpenAI a analizat și modelul Astra, despre care compania nu a putut exclude posibilitatea de a fi ajuns la un nivel considerat „critic” în domeniul cybersecurity. Într-un asemenea scenariu, un sistem ar putea descoperi și exploata vulnerabilități cu intervenție umană minimă.
OpenAI se teme de atacuri care nu se mai opresc
Chris Lehane spune că una dintre cele mai importante schimbări ar putea fi apariția atacurilor permanente. În locul unei operațiuni punctuale, atacatorii ar putea folosi modele AI care încearcă repetat diferite metode până când găsesc o breșă.
Riscul este amplificat de modelele open-source. Unele dintre acestea sunt la doar câteva luni în urma celor mai performante sisteme închise, spune oficialul OpenAI. Pe măsură ce devin mai accesibile, ele ar putea ajunge și în mâinile grupărilor criminale.
Fenomenul nu este complet ipotetic. Cercetătorii au documentat deja cazuri în care un agent AI ar fi coordonat singur un atac cibernetic, adaptându-se pe parcurs la probleme și continuând operațiunea fără control manual permanent.
În același timp, AI poate fi folosită și pentru apărare. Problema este viteza. Dacă modelele dezvoltă capacități ofensive mai repede decât instrumentele defensive, companiile și instituțiile ar putea fi puse într-o cursă dificilă cu atacatori automatizați.
OpenAI cere reguli obligatorii înainte de lansarea modelelor
Compania a oprit temporar antrenarea unor modele de frontieră pentru introducerea unor măsuri suplimentare de siguranță. Mia Glaese, care coordonează activitatea de safety și alignment, a declarat că situația este departe de revenirea la normal.
Sam Altman a transmis la rândul său că siguranța AI este mai importantă decât ritmul în care avansează o companie. OpenAI vrea ca modelele foarte performante să treacă prin teste obligatorii înainte să poată fi lansate public.
Lehane cere o legislație națională în SUA care să stabilească standarde minime obligatorii pentru modelele AI de frontieră. Ulterior, un astfel de sistem ar putea fi extins la nivel internațional. Ideea ar fi simplă: un model nu ar putea fi lansat dacă dezvoltatorul nu demonstrează că respectă anumite praguri de siguranță.
Presiunea crește și din partea autorităților. Centrul Național pentru Securitate Cibernetică din Marea Britanie a avertizat organizațiile să limiteze autonomia agenților AI și să păstreze permanent posibilitatea opririi lor.
Pentru companii, amenințarea devine tot mai greu de ignorat. Atacurile cibernetice alimentate de inteligența artificială pot combina automatizarea, viteza și adaptarea într-un mod pe care instrumentele clasice de protecție nu au fost concepute să îl gestioneze.
Avertismentul OpenAI arată astfel o schimbare importantă de paradigmă. Întrebarea nu mai este doar dacă AI poate fi utilizată într-un atac informatic. Miza devine cât de autonome pot ajunge aceste sisteme și dacă instrumentele de apărare vor putea evolua suficient de repede pentru a le ține sub control.