Vodeće AI laboratorije sve otvorenije govore o tome da modeli već učestvuju u sopstvenom razvoju, ali se razilaze oko toga koliko daleko taj proces sme da ide. Prema pregledu koji je 19. septembra objavio Asošijeted pres, a preneo ga je i Fortune, OpenAI priznaje da još ne zna kako da bezbedno stigne do potpunog rekurzivnog samopoboljšavanja, dok xAI cilja potpunu automatizaciju najkasnije do 2027. godine.
Rekurzivno samopoboljšavanje, na engleskom recursive self-improvement ili skraćeno RSI, označava AI sistem koji projektuje sledeću verziju samog sebe, pa ta verzija projektuje sledeću. Anthony Aguirre, predsednik i izvršni direktor Instituta Budućnost života (Future of Life Institute), ocenio je da je potpuna autonomija u tom procesu "verovatno najgora ideja u istoriji čovečanstva". Kompanije koje razvijaju modele ne dele tu ocenu u istoj meri.
Anthropic: Claude vodi četvrtinu istraživanja
Prema navodima iz pregleda, Claude trenutno predvodi 26 odsto istraživanja i razvoja modela u Anthropicu. Kompanija je već ranije saopštila taj podatak. Model može da završi većinu zadataka od početka do kraja na osnovu jednog opšteg zadatka, ali uz nadzor ljudi, a Anthropic navodi da sistem još nije potpuno samostalan. Podatke o udelu Claude-a saopštila je sama kompanija, a nezavisna provera u pregledu nije navedena.
Anthropic se istovremeno zalaže za usporavanje. Kako smo ranije pisali, generalni direktor Dario Amodei je tražio da AI kompanije uspore razvoj modela, uz uslov da to učine svi i da se to može proveriti. Predsednik SAD Donald Tramp i kineske vlasti su, prema ranijem izveštavanju, odbacili takav poziv, pa uslov koji Anthropic postavlja za sada nije ispunjen.
OpenAI: istraživački pripravnik i rok do 2028.
OpenAI je razvio automatizovanog "istraživačkog pripravnika", sistem koji obavlja jasno definisane istraživačke zadatke za koje bi iskusnom istraživaču trebalo nekoliko dana. Cilj kompanije je potpuno automatizovan AI istraživač do marta 2028. godine.
Istovremeno, OpenAI navodi da pomoć AI-ja u istraživanju ne znači da je brzo rekurzivno samopoboljšavanje ishod kome treba težiti. Kompanija priznaje da ne zna kako bi bezbedno stigla do potpuno usklađenog RSI-ja i da ne može da pretpostavi da će napredak u bezbednosti pratiti napredak u sposobnostima. Odluka o tome da li i kako nastaviti, kako stoji u saopštenju, mora da zavisi od sposobnosti da se očuva ljudska kontrola. Slično upozorenje je ranije stiglo i iznutra: Pachocki iz OpenAI-ja tražio je hitno usporavanje.
xAI i Microsoft: dve suprotne strane
Najagresivniji rok navodi xAI. Elon Musk je rekao da je ljudi sve manje u petlji poboljšavanja Grok modela i da svaki sledeći model gradi prethodni, iako proces još nije završen. Prema AP-u, cilj je potpuna automatizacija najkasnije do 2027. godine. Agencija ne navodi dodatne tehničke detalje o tome kako je taj proces organizovan.
Microsoft je na suprotnom kraju. Kompanija govori o "humanističkoj superinteligenciji", odnosno o naprednim sistemima koji su pažljivo kalibrisani i deluju unutar granica, i izričito odbacuje neograničene autonomne sisteme.
Šta ostaje otvoreno
Pregled pokazuje da se razlika između laboratorija ne tiče toga da li AI pomaže u razvoju AI-ja, jer to rade sve, već toga ko i pod kojim uslovima određuje tempo. Nijedna kompanija u pregledu ne tvrdi da je razvoj potpuno autonoman. OpenAI navodi da ljudska kontrola mora da ostane, a Anthropic da Claude radi pod nadzorom. Aguirre je istakao da grafikoni koje objavljuje Anthropic pokazuju kako se sve veći deo istraživanja obavlja uz pomoć AI-ja, što je, po njegovoj oceni, razlog za oprez. Kako bi se ta granica proveravala i ko bi je nametnuo, ako se konkurenti ne slože, ostaje bez odgovora. Nije poznato ni da li će rokovi koje navode OpenAI i xAI biti ispoštovani, jer se radi o ciljevima kompanija, a ne o potvrđenim rezultatima.
Često postavljana pitanja
Šta je rekurzivno samopoboljšavanje?
To je proces u kome AI sistem učestvuje u projektovanju svog naslednika, koji zatim projektuje sledeći model. U punom obliku, ljudi bi bili sve manje uključeni u taj lanac.
Da li Claude sam razvija svoje nove verzije?
Ne u potpunosti. Prema Anthropicu, Claude vodi 26 odsto istraživanja i razvoja modela i može da završi većinu zadataka od početka do kraja, ali uz nadzor ljudi.
Do kada OpenAI planira automatizovanog istraživača?
Kompanija navodi cilj potpuno automatizovanog AI istraživača do marta 2028. godine. Već ima sistem koji radi zadatke za koje bi iskusnom istraživaču trebalo nekoliko dana.
Šta kaže xAI?
Prema AP-u, xAI cilja potpunu automatizaciju poboljšavanja Grok modela najkasnije do 2027. godine.
