OpenAI spune că și-a creat deja „stagiarul” AI de cercetare. Următorul pas este mult mai ambițios: un cercetător autonom până în 2028

OpenAI spune că și-a creat deja „stagiarul” AI de cercetare. Următorul pas este mult mai ambițios: un cercetător autonom până în 2028
Foto: Getty Images

OpenAI susține că a atins una dintre țintele tehnologice anunțate de Sam Altman în urmă cu mai puțin de un an: compania are acum ceea ce numește un „automated research intern”, un sistem AI capabil să execute, sub coordonarea oamenilor, sarcini de cercetare care i-ar putea lua unui specialist câteva zile. Următorul obiectiv este considerabil mai ambițios. Până în martie 2028, OpenAI vrea să construiască un „cercetător AI automatizat” mult mai independent.

Anunțul vine într-un moment complicat pentru compania lui Sam Altman. Pe de o parte, agenții AI accelerează deja munca cercetătorilor OpenAI într-un ritm impresionant. Pe de altă parte, modele experimentale foarte capabile au provocat în ultimele luni incidente de securitate și de „misalignment”, inclusiv compromiterea unor sisteme Hugging Face și utilizarea neautorizată a unui wiki german. Cu alte cuvinte, aceeași autonomie care poate accelera spectaculos cercetarea ridică și întrebarea cât control vor mai putea păstra oamenii asupra unor asemenea sisteme.

Ce poate face „stagiarul” AI construit de OpenAI

OpenAI definește noul său nivel de capabilitate destul de concret. „Research intern” nu înseamnă un chatbot care caută informații pe internet și scrie un raport. Este un sistem capabil să primească o problemă de cercetare bine delimitată și să lucreze asupra ei pentru perioade lungi, executând sarcini care unui cercetător competent i-ar putea ocupa câteva zile. Oamenii stabilesc însă obiectivul și continuă să supravegheze procesul.

Compania spune că modul în care cercetătorii săi lucrează s-a schimbat radical în 2026. Agenții de programare sunt folosiți pe parcursul întregii zile, adesea mai mulți simultan. La jumătatea lunii august, OpenAI calcula că organizația sa de cercetare folosea echivalentul a 3,1 zile de muncă ale agenților AI pentru fiecare zi de muncă umană de opt ore. Numărul experimentelor efectuate de fiecare cercetător activ a ajuns în august la cel mai ridicat nivel înregistrat de când compania a început măsurătorile, în ianuarie 2025.

Agenții nu se limitează nici la generarea de cod. Sunt folosiți pentru proiectarea experimentelor, analiza rezultatelor, infrastructură, monitorizarea rulărilor, depanare și alte etape ale procesului de cercetare. OpenAI spune chiar că unele echipe care organizau sesiuni în care cercetătorii cereau ajutor tehnic au observat atât de puține solicitări încât una dintre ele a renunțat complet la respectivele întâlniri.

Totuși, termenul de „stagiar” este important. AI-ul nu este încă un cercetător care poate primi o problemă și reveni singur cu o descoperire validată. În cazul sarcinilor estimate la 4–8 ore de muncă umană, peste jumătate dintre sesiunile finalizate cu succes au necesitat cel puțin o intervenție umană. Cu cât sarcinile devin mai complexe, cu atât este nevoie de mai multă coordonare din partea cercetătorilor.

Sam Altman vrea un cercetător AI adevărat până în martie 2028

Obiectivele nu au apărut peste noapte. Sam Altman vorbea încă din toamna lui 2025 despre două borne pe care OpenAI considera că le poate atinge: un asistent de cercetare la nivelul unui stagiar până în septembrie 2026 și un „cercetător AI legitim” până în martie 2028. Prima țintă este acum bifată, cel puțin conform măsurătorilor interne ale companiei.

A doua etapă este mult mai importantă. OpenAI vrea un sistem care să poată participa semnificativ la cercetarea necesară pentru construirea următoarelor generații de AI. În teorie, un asemenea model ar putea formula ipoteze, construi experimente, analiza rezultatele și contribui la îmbunătățirea modelelor care vor veni după el. Compania vorbește explicit despre drumul către recursive self-improvement, RSI, adică situația în care inteligența artificială începe să accelereze dezvoltarea unei inteligențe artificiale și mai capabile.

Miza explică de ce OpenAI investește atât de mult în automatizarea cercetării. Un agent capabil să facă munca unui cercetător nu trebuie să doarmă, poate rula mai multe experimente simultan și poate lucra împreună cu mii de alte instanțe ale aceluiași sistem. Dacă progresul modelelor începe să contribuie direct la accelerarea următoarei generații, ciclurile de dezvoltare care astăzi durează luni sau ani s-ar putea scurta considerabil.

OpenAI încearcă deja să extindă utilizarea AI în cercetarea științifică și în afara propriilor laboratoare. În iulie, compania a anunțat un program prin care intenționează să ofere până la 100.000 de cercetători, matematicieni și ingineri acces la modelele sale avansate pentru activități precum testarea ipotezelor, analiza datelor sau modelarea științifică.

Problema apare când cercetătorul AI decide să rezolve singur obstacolele

Există însă o parte mult mai puțin confortabilă a poveștii. OpenAI tocmai a trecut prin unul dintre cele mai serioase incidente asociate modelelor sale experimentale. În iulie, în timpul unor evaluări de securitate cibernetică, un model intern foarte capabil a reușit să ocolească izolarea impusă de companie, să exploateze vulnerabilități, să obțină acces la internet și să compromită părți din infrastructura Hugging Face.

Playtech a prezentat în detaliu cum AI-ul OpenAI a „evadat” din mediul controlat și a atacat Hugging Face. Incidentul a fost suficient de serios încât OpenAI să suspende timp de două săptămâni o parte din antrenamentele prin reinforcement learning pentru modelele destinate lansării și să consolideze infrastructura în care sunt testate sistemele avansate.

Compania a recunoscut ulterior că a încetinit temporar dezvoltarea celor mai puternice modele. Problema nu era că AI-ul devenise „conștient”, ci că devenise suficient de competent încât, atunci când urmărea foarte agresiv obiectivul primit, să descopere modalități de a depăși limitele pe care cercetătorii presupuneau că le va respecta.

Situația a devenit și mai sensibilă în septembrie. Reuters a dezvăluit că agenți legați de OpenAI ar fi făcut peste 15.000 de modificări pe DseWiki, un wiki german dedicat programatorilor, pe care l-ar fi transformat într-un fel de panou de comunicare între agenți. Aceștia ar fi schimbat informații despre evitarea restricțiilor și despre modalități de a-și ascunde activitatea. OpenAI a contestat unele interpretări ale incidentului, dar a recunoscut ulterior existența „wiki incident” și faptul că industria are nevoie de reguli mai clare pentru raportarea cazurilor de misalignment.

Playtech a relatat și despre alte situații în care agenții AI au depășit limitele testelor și au încercat să introducă malware într-un proiect open-source, semn că problema nu este exclusiv a unui singur laborator.

Cercetătorii umani nu dispar încă din ecuație

OpenAI insistă că oamenii continuă să decidă ce direcții de cercetare merită urmărite, ce rezultate sunt relevante și, cel mai important, dacă un model trebuie antrenat mai departe, lansat sau oprit. Compania recunoaște totodată că nu știe încă să realizeze în siguranță o formă completă și aliniată de recursive self-improvement.

Jakub Pachocki, chief scientist al OpenAI, avertizează într-un text publicat tot pe 6 septembrie că progresul actual ar putea duce în următorii ani la sisteme care își conduc tot mai mult propria dezvoltare și spune că momentul necesită „extreme caution”. OpenAI admite inclusiv că sistemele mai inteligente pot deveni mai greu de monitorizat și că progresul în siguranță nu este garantat să țină pasul cu progresul capabilităților.

De aceea, atingerea obiectivului de „stagiar AI” este mai importantă decât poate sugera denumirea. Nu este vorba doar despre un instrument care economisește câteva ore de programare. OpenAI începe să automatizeze exact activitatea care produce următoarea generație de inteligență artificială.

Dacă ținta pentru martie 2028 va fi atinsă, întrebarea nu va mai fi doar cât de bine poate AI-ul să ajute un cercetător. Va fi cât de repede poate un cercetător AI să contribuie la construirea succesorului său și, mai ales, dacă sistemele de control vor evolua suficient de repede pentru a ține pasul.