Anthropic je 7. avgusta saopštio da je preradio bezbednosne filtere modela Claude Fable 5, pošto su korisnici mesecima prijavljivali da sistem odbija da odgovori i na sasvim bezazlena pitanja iz biologije i medicine. Prema podacima kompanije, broj takozvanih fallback odgovora, situacija u kojoj Fable 5 umesto direktnog odgovora prebacuje upit na slabiji model Opus 5, smanjen je za oko 85 odsto na svim proizvodima Anthropica.
Koliko se stvarno promenilo
Kompanija navodi da je pad broja svih vrsta fallback odgovora najizraženiji na Claude.ai, gde iznosi 67 odsto. Na Cowork alatu za timski rad promena je 55 odsto, dok je kod Claude Code, alata namenjenog programerima, efekat znatno skromniji, svega 17 odsto. Najmanja razlika zabeležena je na Claude Platform interfejsu za programere koji grade sopstvene aplikacije, gde pad iznosi 7 odsto. Anthropic tvrdi da će korisnici sada ređe nailaziti na blokade kada traže pomoć oko tumačenja nalaza iz laboratorije, razumevanja simptoma ili učenja biologije u obrazovnom kontekstu, a da će i zdravstveni radnici dobijati više podrške za kliničke zadatke.
Zašto su filteri uopšte bili tako strogi
Kada je Fable 5 predstavljen, Anthropic je uveo, po sopstvenom priznanju, izuzetno široke biološke klasifikatore koji su radije blokirali bezopasno pitanje nego rizikovali da propuste nešto opasno. Razlog je model koji, prema navodima kompanije, dostiže granične sposobnosti u biologiji i u pojedinim zadacima nadmašuje stručnjake, što otvara realan rizik zloupotrebe u takozvanim dual use oblastima. Anthropic se u saopštenju poziva na procenu američke obaveštajne zajednice za 2026. godinu, prema kojoj državni akteri i dalje verovatno održavaju aktivne ofanzivne programe za biološko i hemijsko oružje. Osetljivost teme dodatno je pojačana time što je upravo oko sposobnosti Fable modela ranije izbila diplomatska prepirka, pošto su Sjedinjene Države optužile Kinu za navodnu krađu Fable modela putem industrijske špijunaže. Otkako je Fable 5 izašao, korisnici su se na forumima za programere i u društvenim mrežama žalili da im model odbija da objasni osnovne pojmove iz biologije za školske zadatke ili da protumači nalaz krvi, što je Anthropic naveo kao neposredan povod za reviziju pravila.
Šta i dalje ostaje zabranjeno
Uprkos ublažavanju, Fable 5 se i dalje automatski prebacuje na Opus 5 kada prepozna upite iz virusologije, toksikologije ili molekularnog dizajna, oblasti koje Anthropic smatra najosetljivijim na zloupotrebu. Model, kako kompanija navodi, i dalje nije namenjen za profesionalna istraživanja u biologiji niti za razvoj lekova. Anthropic najavljuje da radi na takozvanim pouzdanim pristupnim kanalima za proverene istraživače, kroz koje bi u budućnosti moglo da se otvori više graničnih bioloških sposobnosti modela uz dodatnu proveru identiteta i namene. Kompanija priznaje i da će određeni broj lažnih blokada ostati prisutan, jer sistem i dalje zadržava sigurnosnu marginu u kojoj se pojedini niskorizični upiti mogu pogrešno označiti kao problematični.
Metodologija iza izmene, prema opisu kompanije, obuhvatila je tri koraka. Anthropic je prvo prepisao takozvani ustav klasifikatora, skup pravila koji određuje šta se smatra zaštićenim a šta dozvoljenim sadržajem, uvodeći detaljnije izuzetke za legitimne, svakodnevne upotrebe. Potom je prikupio povratne informacije od raznovrsne grupe internih i spoljnih stručnjaka za biosigurnost. Na kraju je generisao nove podatke za treniranje koji odražavaju izmenjena pravila i ponovo istrenirao klasifikator, uz proveru da i dalje blokira zaista štetne zahteve. Reč je o istom modelu koji je Anthropic nedavno vratio u standardne pretplatničke pakete, gde su korisnici Max i Team Premium planova dobili pristup uz ograničene nedeljne limite.
Često postavljana pitanja
Šta je Claude Fable 5?
Fable 5 je Anthropicov model sa graničnim sposobnostima u oblasti biologije, koji kompanija zbog toga izdvaja posebnim, strožim bezbednosnim filterima u odnosu na ostale Claude modele.
Šta znači fallback odgovor?
To je situacija u kojoj Fable 5 prepozna upit kao potencijalno rizičan i automatski ga prosledi slabijem modelu Opus 5, umesto da odgovori direktno.
Za koliko je smanjen broj lažnih blokada?
Anthropic navodi pad od oko 85 odsto u ukupnom broju bioloških fallback odgovora na svim proizvodima, sa najvećim padom na Claude.ai a najmanjim na Claude Platform.
Da li Fable 5 sada sme da se koristi za profesionalna istraživanja u biologiji?
Ne. Model i dalje nije namenjen za profesionalna istraživanja ili razvoj lekova, a upiti iz virusologije, toksikologije i molekularnog dizajna i dalje se automatski blokiraju.
Zašto je Anthropic uopšte uveo tako stroge filtere?
Kompanija navodi da Fable 5 u pojedinim biološkim zadacima nadmašuje stručnjake, što otvara rizik da bi mogao da pomogne u razvoju bioloških ili hemijskih oružja, pa je prvobitno birala oprez po cenu većeg broja lažnih blokada.
