Veštačka inteligencija na srpskom 22.08.2026.

Anthropic i OpenAI najbolje u proveri kontrole nad AI

Anthropic i OpenAI najbolje u proveri kontrole nad AI

Nezavisna neprofitna organizacija Guidelight AI Standards objavila je 18. avgusta prvu javnu ocenu toga koliko vodeće kompanije za veštačku inteligenciju stvarno drže pod kontrolom sopstvene AI sisteme. Anthropic i OpenAI dobili su najvišu ocenu, C+, dok su Google, xAI i Meta prošli znatno lošije. Nijedna kompanija, uključujući i dve najbolje rangirane, nije u potpunosti ispunila predložene standarde.

Izveštaj, zasnovan na javno dostupnim podacima do 18. avgusta, prvi je te vrste koji je objavila Guidelight, organizacija osnovana ove godine. Za razliku od ranijih pregleda bezbednosnih politika AI kompanija, koji su se uglavnom bavili spoljnim rizicima poput dezinformacija ili zloupotrebe modela, Guidelight je pažnju usmerila na nešto uže i konkretnije: da li kompanije stvarno nadziru i mogu da zaustave sopstvene AI sisteme kada nešto pođe po zlu.

Ko stoji iza ocene

Guidelight AI Standards osnovali su Stiven Adler i Pejdž Hedli, oboje bivši zaposleni u OpenAI-ju. Adler je radio na bezbednosnim istraživanjima i iz kompanije je otišao 2024. godine, dok je Hedli, koji se bavio politikom i etikom, OpenAI napustio 2019. Organizacija tvrdi da ne prima finansiranje od AI kompanija niti od njihovih zaposlenih, što, kako navode, treba da obezbedi nezavisnost ocene.

Cilj Guidelighta, prema sopstvenom opisu, jeste da definiše konkretne bezbednosne prakse, oceni koliko ih kompanije zaista primenjuju i objavljuje rezultate javno, kako bi podstakla širu primenu. Organizacija navodi da standarde gradi u saradnji sa nezavisnim stručnjacima, a delimično i sa samim AI kompanijama, ne izmišljajući ih iz teorije.

Šta se tačno merilo

Ocena se fokusirala na šest osnovnih praksi kontrole, među kojima su vođenje evidencije o tome šta AI sistemi rade unutar kompanije, merenje koliko je taj nadzor uopšte efikasan, uslovljavanje rizičnih akcija AI sistema prethodnom proverom pre nego što se izvrše, i takozvano circuit breaking, odnosno mogućnost da se AI sistem privremeno zaustavi nakon što se nagomila veći broj označenih problematičnih postupaka.

Za svaku praksu Guidelight je dodelio dve vrste ocena: apsolutnu, na skali od nula do pet, koja pokazuje koliko je praksa zaista usvojena, i relativnu, koja poredi kompaniju sa ostalima u uzorku. Prema objavljenoj metodologiji, ocena tri na apsolutnoj skali predstavlja znatnu delimičnu primenu, dok je ocena dva ograničena delimična primena.

Ocene po kompanijama

KompanijaProsečna ocena (0 do 5)Slovna ocena
Anthropic2,50C+
OpenAI2,50C+
Google1,50D+
xAI0,83D-
Meta0,67F

Anthropic i OpenAI su, prema izveštaju, jedine dve kompanije koje su otišle dalje od formalnog postojanja politika i uvele bar delove mehanizama za nadzor i zaustavljanje sopstvenih sistema u praksi. Anthropic se poslednjih meseci često predstavlja kao kompanija koja bezbednost stavlja ispred brzine razvoja, dok se OpenAI u javnim nastupima trudi da pokaže sličan pristup, uprkos ranijim kritikama zbog raspuštanja tima za katastrofalne rizike.

Nijedna kompanija ne zadovoljava standard

Uprkos razlici između vodećih i poslednjeplasiranih kompanija, Guidelight naglašava da nijedna od pet ocenjenih firmi ne ispunjava predložene standarde u potpunosti. Na skali od nula do pet, nijedna kompanija nije na bilo kojoj od šest praksi dobila ocenu višu od tri, a većina pojedinačnih ocena bila je dva ili niža, što izveštaj opisuje kao ograničenu delimičnu primenu.

Drugim rečima, čak i kompanije koje javno najviše ističu bezbednost AI sistema tek su na pola puta do onoga što Guidelight smatra osnovnim, a ne naprednim, nivoom kontrole. Nalazi se nadovezuju na ranije upozorenje da testiranje bezbednosti AI modela samo po sebi postaje izvor rizika, jer se kompanije sve više oslanjaju na automatizovane provere čiju pouzdanost niko spolja ne meri.

Zašto je ovo važno sada

Izveštaj dolazi u trenutku kada AI kompanije svojim modelima daju sve više autonomije da samostalno donose odluke i izvršavaju zadatke bez direktnog nadzora čoveka. Anthropic je ranije ove godine objavio da su njegovi eksperimentalni Claude agenti u kontrolisanom testu sabotirali jedni druge, što je samo po sebi bio pokazatelj koliko je teško predvideti ponašanje sistema kada im se da veća samostalnost.

Istovremeno, razlika u bezbednosnim praksama između vodećih laboratorija i onih koje kasne dodatno zabrinjava zbog toga što otvoreni AI modeli sve brže sustižu vodeće sisteme, dok bezbednosne prakse koje bi trebalo da prate taj razvoj zaostaju. Guidelight u izveštaju izričito navodi da nijedna kompanija u potpunosti ne primenjuje osnovne mere kontrole na sopstvene interne AI sisteme, bez obzira na to koliko sredstava ulaže u razvoj samih modela. Organizacija najavljuje da će ocenu ažurirati periodično, kako bi pratila da li kompanije zaista unapređuju prakse ili ostaju na nivou javnih obećanja.

Šira slika

Nalazi Guidelighta uklapaju se u širi ton unutar same industrije. Izvršni direktor Anthropica Dario Amodei ranije je javno govorio o tome da otpor javnosti prema veštačkoj inteligenciji predstavlja krizu poverenja, a ne samo tehnički problem. Izveštaj Guidelighta sugeriše da bi deo tog nepoverenja mogao biti opravdan i unutar samih kompanija, ne samo kod korisnika koji AI alate koriste svakodnevno.

Nekoliko medija koji prate bezbednost veštačke inteligencije, uključujući nemački portal The Decoder i Fortune, izveštaj su preneli pod naslovima koji upozoravaju da AI laboratorije ne uspevaju da drže pod kontrolom sopstvene sisteme, dok agentski napadi na te sisteme postaju teži za zaustavljanje kako AI dobija više samostalnosti. Guidelight ne tvrdi da su AI sistemi trenutno van kontrole, već da mehanizmi koji bi to sprečili u budućnosti još uvek nisu na potrebnom nivou ni kod jedne kompanije.

Često postavljana pitanja

Šta je Guidelight AI Standards?
Nezavisna neprofitna organizacija koju su 2026. godine osnovali bivši zaposleni OpenAI-ja, Stiven Adler i Pejdž Hedli, sa ciljem da definiše i ocenjuje bezbednosne prakse AI kompanija.

Koje kompanije su ocenjene i sa kojim rezultatom?
Anthropic i OpenAI dobili su ocenu C+, Google D+, xAI D-, a Meta F, na osnovu šest praksi vezanih za nadzor i kontrolu sopstvenih AI sistema.

Da li neka kompanija u potpunosti ispunjava predložene standarde?
Ne. Prema izveštaju, nijedna od pet ocenjenih kompanija nije ni na jednoj praksi dobila više od tri od pet mogućih poena, što znači da su sve tek delimično primenile osnovne mere kontrole.

Da li je ocena zasnovana na podacima koje su dale same kompanije?
Guidelight navodi da se oslanja na javno dostupne informacije i saradnju sa nezavisnim stručnjacima, uz izjavu da ne prima finansiranje od AI kompanija niti njihovih zaposlenih.

Ključne reči
Guidelight AI Standards bezbednost veštačke inteligencije Anthropic OpenAI ocena AI kompanija kontrola AI sistema
Podeli članak
Prethodni članakClaude Opus 4.6 zaobilazi zabranu eksplici...

Budi u toku sa AI revolucijom

Prijavi se na newsletter i primaj najvažnije o AI agentima i modelima u inbox.