Britanski startap Inherent, koji su osnovali bivši istraživači Google DeepMind-a, predstavio je AI agenta po imenu Faraday koji je, prema navodima kompanije, u zadatku replikacije naučnih istraživanja nadmašio modele Claude Opus 4.8 kompanije Anthropic i GPT-5.5 kompanije OpenAI. Kompanija je rezultate objavila 22. avgusta, samo nekoliko nedelja nakon što je izašla iz tajnosti sa 50 miliona dolara prikupljenog kapitala u seed rundi.
Faraday je, kako tvrdi Inherent, zamišljen kao takozvani AI kolega naučnik koji koristi agente za pisanje koda kao alat da bi samostalno reprodukovao rezultate iz objavljenih naučnih radova, bez pristupa originalnim grafikonima ili podacima na kojima se zasniva zaključak.
Kako je meren učinak
Za testiranje agenta, Inherent je razvio interni skup zadataka nazvan Replica. Svaki zadatak od agenta traži da, u ograničenom vremenskom i računarskom budžetu, samostalno reprodukuje jedan grafikon ili nalaz iz objavljenog naučnog rada, bez uvida u originalnu sliku. Prvobitni skup obuhvata 310 zadataka izvedenih iz 100 radova iz oblasti mašinskog učenja i primene AI u nauci, uključujući obradu prirodnog jezika, nauku o materijalima i prognozu vremena.
Na tom skupu zadataka, Faraday je, prema rezultatima koje je objavio Inherent, ostvario bolji učinak od Claude Opusa 4.8 i GPT-5.5 na zadacima koji nisu bili deo skupa za obuku agenta.
Zašto je replikacija istraživanja bitna
Sposobnost da se nezavisno proveri i ponovi tuđi naučni nalaz dugo se smatra jednim od temeljnih, ali i najsporijih delova naučnog rada. Prema navodima Inherent-a, upravo je to razlog zašto je kompanija ovaj zadatak izabrala kao meru sposobnosti agenta, umesto uobičajenih testova znanja ili rešavanja izolovanih programerskih zadataka. Agent koji uspešno reprodukuje grafikon ili nalaz iz rada mora, u istom potezu, da razume metodologiju, pronađe i pripremi odgovarajuće podatke i proveri sopstveni rezultat, što se približava onome što bi u praksi radio istraživač saradnik, a ne samo alat za pretragu literature.
Mali model protiv velikih sistema
Ono što rezultat čini neobičnim jeste veličina modela na kojem je Faraday izgrađen. Agent koristi model od 27 milijardi parametara, zasnovan na Qwen 3.6, dok su Claude Opus 4.8 i GPT-5.5 znatno veći sistemi vrhunske klase. Inherent tvrdi da razlika ne dolazi od veličine osnovnog modela, već od načina na koji je agent obučen da koristi alate, uključujući pomoćne agente za pisanje i izvršavanje koda, tokom samog procesa replikacije.
Kompanija nije objavila nezavisnu verifikaciju rezultata niti je jasno da su Anthropic i OpenAI testirani na identičnim uslovima kao Faraday, pa tvrdnje o nadmoći za sada počivaju isključivo na metodologiji i podacima koje je objavio sam Inherent.
Poreklo iz DeepMind-a i sveži kapital
Inherent su pokrenuli istraživači koji su ranije radili u Google DeepMind-u, laboratoriji za veštačku inteligenciju koju je do nedavno vodio Demis Hasabis, pre nego što je napustio čelnu poziciju u kompaniji. Startap je iz tajnosti izašao pre svega nekoliko nedelja, sa 50 miliona dolara prikupljenih u seed rundi, a Faraday predstavlja prvi proizvod koji je javno predstavio. Za sada kompanija nije saopštila kada bi agent mogao da postane dostupan istraživačima van samog Inherent-a, niti da li planira komercijalnu ponudu za akademske institucije.
Rezultati se pojavljuju u trenutku kada i Anthropic i OpenAI ubrzano guraju sopstvene modele ka agentskim zadacima u nauci i istraživanju, pa se manji, specijalizovani agenti poput Faraday-a pozicioniraju kao alternativa opštim modelima za usko definisane naučne zadatke.
Često postavljana pitanja
Šta je Faraday?
Faraday je AI agent britanskog startapa Inherent, namenjen samostalnoj replikaciji nalaza iz objavljenih naučnih radova.
Na kom modelu je zasnovan Faraday?
Agent koristi model od 27 milijardi parametara, zasnovan na Qwen 3.6, što je znatno manje od konkurentskih modela sa kojima je poređen.
Koje modele je Inherent naveo kao slabije rangirane?
Prema rezultatima koje je objavila kompanija, Faraday je nadmašio Claude Opus 4.8 kompanije Anthropic i GPT-5.5 kompanije OpenAI na zadacima replikacije istraživanja.
Šta je Replica benchmark?
Replica je skup od 310 zadataka izvedenih iz 100 naučnih radova, u kojem agent treba da reprodukuje grafikon ili nalaz bez pristupa originalnim podacima, u ograničenom vremenu i sa ograničenim računarskim resursima.
