Kompanije Anthropic i OpenAI najavile su da će unutar sopstvenih timova ugraditi nezavisne procenjivače bezbednosti, sa pristupom koji do sada nije bio dostupan spoljnim istraživačima. Predlog je iznet u opsežnom eseju izvršnog direktora Anthropica Darija Amodeja, objavljenom tokom prošlog vikenda, a Sem Altman je potvrdio da će i OpenAI prihvatiti sličan pristup, piše TechCrunch.
Šta tačno predlaže Amodei
Prema Amodejevom predlogu, organizacije poput METR i Redwood Research dobile bi ono što on naziva neviđenim pristupom internim sistemima kompanija. Evaluatori bi mogli da prijavljuju bezbednosne incidente, procenjuju da li su modeli zaista usklađeni sa namerama tvoraca i objavljuju nalaze javnosti bez uredničkog nadzora Anthropica. Amodei je ranije ove godine pozivao AI kompanije da uspore razvoj najnaprednijih modela, upozoravajući na rizike brzine kojom industrija napreduje.
Altman je saopštio da će OpenAI takođe prihvatiti praksu ugrađenih procenjivača, iako kompanija za sada nije objavila detalje o tome koje organizacije će angažovati niti kada bi taj proces trebalo da počne.
Sumnje u stvarnu nezavisnost
Predstavnici evaluatorskih organizacija sa kojima je razgovarao TechCrunch generalno su pozdravili inicijativu, ali upozoravaju da mnogi detalji ostaju nejasni. Glavni prigovor tiče se kontrole nad objavljivanjem nalaza. Dosadašnja praksa tretirala je procenjivače kao obične izvođače, vezane ugovorima koji kompanijama daju poslednju reč o tome šta sme da bude objavljeno. Intelektualna svojina ovih kompanija im je izuzetno dragocena, ukazuju sagovornici lista, izražavajući sumnju da će firme zaista dopustiti punu transparentnost.
Kao primer nedovoljnog vremena za temeljnu procenu, navodi se da su METR i Redwood Research imali svega nedelju dana da istraže bezbednosni incident povezan sa Hugging Face, dok je Apollo Research dobio samo tri dana da testira OpenAI-jev model Astra, koji je kompanija naknadno svrstala u kritičan bezbednosni rizik. Kratki rokovi, upozoravaju istraživači, znače da niska stopa uočenog lošeg ponašanja modela ne predstavlja pouzdan dokaz da je model bezbedan, jer jednostavno nije bilo dovoljno vremena da se problem otkrije.
Nijedan od dva predloga, ni Amodejev ni postojeći okvir OpenAI-ja, ne predviđa da evaluatori dobiju ovlašćenje da zaustave razvoj ili objavljivanje modela ako procene da nije bezbedan. Ostaje im samo mogućnost da izveste o nalazima, ne i da spreče lansiranje.
Ko još nije pristao
Meta, SpaceX AI i Google DeepMind za sada nisu prihvatili obavezu ugrađivanja nezavisnih procenjivača, što predlog Amodeja i Altmana ostavlja ograničenim na deo industrije. Anthropic je ranije javno priznao propuste u sopstvenoj obuci Claude modela, što delimično objašnjava zašto kompanija sada zagovara strožu spoljnu kontrolu.
Regulatorni okvir delimično već postoji. Kalifornijski zakoni SB 53 i SB 813, kao i evropski AI Act, zahtevaju određene oblike nezavisne evaluacije AI modela, ali nijedan od njih ne ide tako daleko kao Amodejev predlog o stalno ugrađenim procenjivačima sa pristupom internim sistemima. Bez zakonske obaveze, ostvarenje predloga zavisiće od dobre volje kompanija koje su ga iznele.
METR i Redwood Research su neprofitne istraživačke organizacije koje su se poslednjih godina profilisale kao vodeći spoljni procenjivači rizika naprednih AI modela, uključujući testiranja mogućnosti modela da samostalno deluju bez nadzora čoveka. Njihovo dosadašnje iskustvo, sa ograničenim rokovima i ugovornim uslovima koje su same opisale kao restriktivne, deo je razloga zbog kojih Amodejev predlog izaziva pažnju šire zajednice koja se bavi bezbednošću veštačke inteligencije. Da li će predlog dovesti do stvarne promene prakse ili ostati na nivou javne izjave, zavisiće od toga koliko detalja Anthropic i OpenAI budu spremni da objave u narednim mesecima.
Često postavljana pitanja
Ko je predložio ugrađivanje nezavisnih procenjivača?
Predlog je iznet u eseju Darija Amodeja, izvršnog direktora Anthropica, objavljenom sredinom septembra 2026. Sem Altman je u ime OpenAI-ja potvrdio da će kompanija prihvatiti sličan pristup.
Koje organizacije bi mogle da dobiju taj pristup?
Kao primeri se pominju METR i Redwood Research, organizacije koje su ranije radile bezbednosne procene za obe kompanije.
Da li procenjivači mogu da zaustave objavljivanje modela?
Ne. Ni Amodejev predlog ni postojeći okvir OpenAI-ja ne daju evaluatorima ovlašćenje da spreče razvoj ili lansiranje modela, samo da izveštavaju o nalazima.
Zašto stručnjaci sumnjaju u nezavisnost procenjivača?
Zbog dosadašnje prakse ugovora koji kompanijama daju kontrolu nad tim šta procenjivači smeju da objave, kao i zbog kratkih rokova koje su dosad dobijali za istraživanja.
Da li sve velike AI kompanije prihvataju ovu praksu?
Ne. Meta, SpaceX AI i Google DeepMind za sada nisu prihvatile obavezu ugrađivanja nezavisnih procenjivača bezbednosti.
