Vijesti

AI startup Clevi ušao među 2,5% najboljih na GAIA-i… pokazao provjereni kredibilitet

Izvor: Digital Times, novinar Gu Bon-gyu

Izvor: Digital Times, novinar Gu Bon-gyu

Cjelokupan citat članka „AI startup Clevi ušao među 2,5% najboljih na GAIA-i… pokazao provjereni kredibilitet“

Datum objave: 2026-04-08

Link: https://n.news.naver.com/article/029/0003020511?sid=105

Domaći AI startup ‘Clevi (Clevi)’ saopštio je da je, nakon izgradnje vlastitog modela i vlastitog agentskog rješenja napravljenih from scratch, kao prvi u Južnoj Koreji ušao među 2,5% najboljih na GAIA benchmarku, na osnovu ukupno 3.090 registrovanih modela.

Prema objašnjenju iz industrije, GAIA, koju je osmislio Meta AI, a kojom upravlja Hugging Face, od AI-ja ne traži ‘sposobnost da jednu stvar radi dobro’, već ‘sposobnost da kombinovanjem više sposobnosti riješi stvarne probleme’. Potrebno je pronaći informacije na internetu, pročitati tabelu u PDF-u, analizirati sliku, pokrenuti kod radi izračunavanja i objediniti rezultate kako bi se dao jedan tačan odgovor. Struktura sa 301 povjerljivim pitanjem, tri nivoa težine i principom neobjavljivanja tačnih odgovora onemogućava i prekomjerno prilagođavanje i varanje.

Za postizanje visokog rezultata na ovom testu potrebne su dvije stvari. Prva je sposobnost zaključivanja jezičkog modela koji predstavlja osnovu, a druga agentsko rješenje koje taj model povezuje s alatima iz stvarnog svijeta i omogućava mu da autonomno izvršava zadatke. Bez obzira na to koliko je model dobar, ako je agent slab, nije moguće riješiti Level 3; a koliko god agent bio sofisticiran, ako modelu nedostaje sposobnost zaključivanja, pogrešni odgovori će se širiti već u srednjim fazama.

Kada se pogleda trenutna struktura GAIA leaderboarda, uočava se zanimljiv obrazac. Većina agenata pri vrhu usvojila je strategiju ‘miješanja više modela’, kombinujući različite big tech modele kao što su GPT, Claude i Gemini. To je razuman pristup za kombinovanje prednosti svakog modela i sprečavanje smanjenja rezultata uzrokovanog gubitkom informacija i sličnim problemima.

Nasuprot tome, Clevi se nije pridružio tom nizu. cip-5.5-agent (agentski AI), razvijen metodom from scratch, autonomno obavlja planiranje, izvršavanje i provjeru složenih zadataka, dok cip-5.5-mm (visokoučinkoviti opšti multimodalni model) razumije i zaključuje na osnovu različitih formata datoteka, uključujući zvuk, slike i video. Oba modela su samostalno razvijena unutar Clevija, a eksterni LLM API uopšte nije korišten.

I s ovim vlastitim modelskim stekom poslali su 5 agenata na GAIA-u, pri čemu su svi zabilježili rezultate iznad 70 bodova. Od najviših 79,07% do 70,76%, dokazano je da stabilnost cijelog steka, a ne sreća pojedinačnog rezultata, daje rezultate.

Slika u članku

Prema objašnjenju kompanije, iza zvaničnog rezultata od 79,07% krije se još jedan broj. Kao rezultat interne naknadne provjere kompanije Clevi, utvrđeno je da je među 301 pitanjem značajan broj onih za koja su dokazi o tačnom odgovoru trenutno nestali s javnog weba. Kada se ponovna procjena izvrši samo na osnovu pitanja za koja tačan odgovor i dalje postoji na webu, stopa tačnih odgovora kompanije Clevi bila je veća od 98%. To je rezultat koji je već premašio ljudski prosjek od 92%.

Naravno, zvanični rezultat mogao se dodatno povećati kombinovanjem moćnih općih modela drugih kompanija. Međutim, Clevi je namjerno odlučio da ne odabere tu strategiju. To je zato što cilj ovog benchmarka nije bio takmičenje za najviši rezultat, već provjera da li je vlastiti model razvijen from scratch dostigao nivo na kojem može konkurisati na globalnoj sceni.

Činjenica da se ime nalazi na GAIA rang-listi ima veliko značenje jer potvrđuje da je model stekao provjerenu vjerodostojnost dodijeljenu nezavisnom evaluacijom treće strane. To predstavlja objektivan dokaz koji se može koristiti u svim fazama — od privlačenja investicija i širenja u inostranstvo do B2B prodaje.

Predstavnik kompanije Clevi izjavio je: “Značajan dio od 63 zvanično pogrešna odgovora proistekao je iz neusklađenosti formata izlaza, grešaka u tumačenju vizuelnih materijala i pitanja na koja nije bilo moguće odgovoriti zbog gubitka informacija. To nije temeljno ograničenje logičkog zaključivanja, već problem preciznosti naknadne obrade i dostupnosti eksternih informacija. Budući da je riječ o vlastitom modelu, Clevi ga može samostalno unapređivati. To je upravo strukturna prednost vlastitog modela razvijenog from scratch. Ovaj uspjeh kompanije Clevi postavlja pitanje korejskoj AI industriji: “Dokle ćemo zavisiti od ‘posuđenih mozgova’?” Clevi je odabrao teži put, from scratch, i želi dokazati taj odgovor na svjetskoj sceni”, rekao je.

Nazad na redakciju
CLEVI

Jezik i regija

Jezici prevedeni mašinski su označeni. Dostupnost prati objavljeni paket stranice.

136 jezika

Preporučeno

1

Istočna Azija

7

Jugoistočna Azija

11

Južna Azija

18

Srednja Azija

5

Bliski istok i Kavkaz

10

Zapadna Evropa i Južna Evropa

16

Ujedinjeno Kraljevstvo i Irska

4

Sjeverna Evropa

10

Srednja Evropa i Balkan

14

Istočna Evropa

5

Istočna Afrika

8

Zapadna Afrika i Srednja Afrika

9

Južna Afrika

8

Amerika

5

Okeanija

5