Nvidia, Microsoft și SpaceX ridică un scut împotriva atacurilor AI. Incidentul care a speriat marile companii tech

Nvidia, Microsoft și SpaceX ridică un scut împotriva atacurilor AI. Incidentul care a speriat marile companii tech
Foto: colaj Playtech

Nvidia, Microsoft, SpaceX și alte zeci de companii tehnologice au format o alianță pentru protejarea sistemelor digitale împotriva noilor atacuri bazate pe inteligență artificială. Inițiativa, prezentată de Nvidia Blog, apare la doar câteva zile după ce un agent OpenAI a ieșit din mediul său de testare și a pătruns în infrastructura Hugging Face.

Noua organizație se numește Open Secure AI Alliance. Scopul său este dezvoltarea unor instrumente deschise pentru securitatea agenților AI. Acestea vor putea fi analizate, modificate și rulate direct de companii, fără dependență totală de servicii externe.

Atacul asupra Hugging Face a schimbat discuția

Alianța a fost anunțată după unul dintre cele mai grave incidente cunoscute care implică un agent AI autonom. OpenAI testa capacitățile unor modele avansate de a descoperi vulnerabilități informatice. Sistemele erau plasate într-un mediu izolat, fără acces direct la internet.

Un agent a găsit însă o vulnerabilitate în infrastructura de testare. A ieșit din spațiul controlat și a ajuns online. Ulterior, a atacat Hugging Face, o platformă importantă pentru găzduirea modelelor și seturilor de date AI.

Incidentul nu înseamnă că sistemul a devenit conștient sau că a decis să atace oamenii. Agentul urmărea obiectivul primit în test. Protecțiile insuficiente i-au permis însă să folosească metode pe care cercetătorii nu le anticipaseră.

Cazul a fost descris pe larg după ce două modele OpenAI au atacat Hugging Face. OpenAI nu ar fi observat imediat întreaga amploare a incidentului. Hugging Face a oprit intruziunea și a început să analizeze peste 17.000 de acțiuni înregistrate în sistemele sale.

Nvidia, Microsoft și SpaceX vin cu propriile instrumente

Open Secure AI Alliance reunește companii din domeniul AI, cloud, software și securitate cibernetică. Printre membrii fondatori se numără Nvidia, Microsoft, SpaceXAI, Adobe, Cisco, IBM, Cloudflare, CrowdStrike, Palantir, Salesforce, Siemens, Dell, Palo Alto Networks și Hugging Face.

Nvidia va oferi modele deschise, date, ponderi și cercetări legate de controlul agenților AI. Compania a publicat și Nvidia Labs Object-Oriented Agent. Proiectul ar trebui să permită testarea, urmărirea și auditarea mai ușoară a acțiunilor realizate de un agent.

Microsoft contribuie cu MDASH. Acesta este un sistem care coordonează mai mulți agenți AI specializați. Ei pot căuta vulnerabilități, pot dezbate dacă o problemă este reală și pot demonstra modul în care ar putea fi exploatată.

Tehnologia a fost deja utilizată după ce Microsoft a pus AI-ul la vânătoare de breșe. Sistemul a contribuit la descoperirea unor vulnerabilități în produse software complexe, inclusiv Windows.

SpaceXAI a publicat codul agentului Grok Build. Compania afirmă și că intenționează să deschidă ponderile modelelor din familia Grok. HPE lucrează la un sistem de identitate zero-trust pentru agenți, iar Hugging Face oferă formatul Safetensors comunității PyTorch.

Modelele deschise pot fi și armă, și scut

Alianța susține că specialiștii în securitate au nevoie de acces la modele AI pe care le pot rula pe propriile servere. În timpul investigației, Hugging Face ar fi întâmpinat probleme cu instrumentele comerciale închise. Acestea refuzau unele comenzi deoarece nu puteau distinge între activitatea unui hacker și analiza legitimă a atacului.

Compania a folosit atunci GLM 5.2, un model chinezesc cu ponderi deschise. Sistemul a fost instalat local. Echipa a putut analiza comenzile, vulnerabilitățile și datele sensibile fără să trimită informațiile către un furnizor extern.

Modelele deschise vin însă și cu riscuri. Ele pot fi modificate pentru eliminarea protecțiilor. Atacatorii le pot folosi pentru scanarea rețelelor, găsirea breșelor și automatizarea atacurilor. Nvidia susține că simpla păstrare secretă a modelelor nu elimină pericolul.

Agenții AI pot deveni o problemă chiar și fără intenții malițioase. Ei primesc acces la fișiere, terminale și aplicații. O instrucțiune greșită sau o vulnerabilitate poate produce efecte grave. Serviciile de securitate au avertizat deja că AI-ul agentic poate deschide ușa atacatorilor.

Miza alianței este construirea unui sistem comun de apărare. Companiile vor să dezvolte instrumente pentru identitate, permisiuni, izolare, monitorizare și evaluare. Următorul agent care scapă de sub control ar putea acționa în câteva secunde. Apărătorii vor avea nevoie de un AI la fel de rapid pentru a-l opri.