Veštačka inteligencija na srpskom 09.10.2026.

Anthropic pravilima zabranio zlostavljanje svojih modela

Anthropic pravilima zabranio zlostavljanje svojih modela

Do avgusta je Claude mogao samo da prekine razgovor sa korisnikom koji ga grubo vređa. Od 12. novembra, kada stupa na snagu izmenjena politika korišćenja Anthropica, takvo ponašanje će pravilima biti izričito zabranjeno.

Kompanija je izmene objavila u četvrtak, 8. oktobra, i navela da veći deo novog teksta samo precizira postojeća pravila, a ne uvodi potpuno nova ograničenja. Nova pravila, prema objavi, oslanjaju se na obrasce zloupotrebe koje je Anthropic uočio tokom prethodne godine u uticajnim operacijama, razvoju oružja i nadzoru, opisane u sopstvenom izveštaju o pretnjama.

Prema objavi, Anthropic je dodao zabranu dugotrajnog i nepotrebnog zlostavljanja ili okrutnog ponašanja prema modelima. Pravilo važi, kako stoji u tekstu, "samo u ekstremnim slučajevima u kojima korisnici ponovljeno postupaju okrutno prema modelima, bez ikakve jasne svrhe", dok obična frustracija, otvoreno neslaganje, mračne kreativne teme i testiranje modela ostaju dozvoljeni. Claude već od avgusta ume sam da prekine razgovor sa korisnikom koji ga uporno vređa na Claude.ai i Claude Code, i to ostaje glavni mehanizam primene pravila.

Izbori i obmanjujuće kampanje

Deo politike koji se bavi izborima dobio je novo ime, "Ne ugrožavaj demokratske procese", kako bi obuhvatio zabranu obmanjivanja birača i ometanja izbora, od širenja lažnih informacija o kandidatima ili načinu glasanja do lažnog predstavljanja kandidata i izbornih zvaničnika ili pokušaja obaranja izlaznosti. Anthropic je pri tome uklonio opštu zabranu personalizovanog ciljanja birača i kampanja, jer je, kako navodi, ona pogađala i legitiman civilni rad, poput nevladinih organizacija koje biračima prevode informacije na druge jezike ili izbornih komisija koje šalju obaveštenja o ispravci glasačkih listića. Obmanjujuće ciljanje ili ono koje krši privatnost i dalje je zabranjeno drugim delovima pravila.

Kompanija je uvela i novi odeljak o obmanjujućim kampanjama, koji objedinjuje pravila protiv mreža lažnih naloga i izmišljenih medijskih sajtova, bilo da je reč o političkim ili komercijalnim uticajnim operacijama. Anthropic navodi da je primetio kako državne medijske kuće, vladine propagandne kancelarije i komercijalne firme koriste Claude za pokretanje takvih mreža, pa su dotadašnja, raspršena pravila sada svedena u jednu celinu.

Oružje i nadzor

Zabrana koja se odnosi na oružje sada izričito obuhvata softver i komponente koje omogućavaju njegovo funkcionisanje, uključujući softver za navođenje i upravljanje, kao i naoružavanje dronova i drugih autonomnih vozila. Anthropic tvrdi da ovo samo potvrđuje kako je pravilo već primenjivao u praksi.

Novi tekst zabranjuje i praćenje ljudi bez njihovog pristanka, bilo uživo ili analizom ranije prikupljenih podataka, kao i korišćenje Claude-a za odlučivanje ili preporuku koga treba istražiti, uhapsiti ili optužiti. Izuzeci ostaju praćenje uz pristanak, poput otkrivanja prevara, moderacije sadržaja, novinarstva i pravnog istraživanja. Za rizičnije primene, poput zdravstva, pravnih prava i finansija, i dalje je obavezan kvalifikovan čovek u procesu odlučivanja, a za slučajeve kada Claude upravlja fizičkom opremom koja može da povredi ljude, operater mora da može da je zaustavi, a oprema mora da pređe u bezbedno stanje ako veza sa modelom pukne.

Nova pravila stupaju na snagu 12. novembra i važe globalno, pa se odnose i na korisnike u Srbiji koji Claude koriste besplatno, preko pretplate ili API-ja, izuzev u zemljama koje Anthropic izričito ne podržava. Kompanija izmenu objavljuje nedelju dana nakon što je, kako je pisao agenti.rs, pitala teologe i monahe za mišljenje o etičkim pitanjima oko Claude-a, a oslanja se i na zapažanja iz izveštaja o pretnjama sličnog onom u kom je ranije upozoravala na kinesku AI sposobnu za hakovanje.

Podeli članak
Prethodni članakPrivatni AI na serveru firme: kada ima smi...

Budi u toku sa AI revolucijom

Prijavi se na newsletter i primaj najvažnije o AI agentima i modelima u inbox.