Vijesti

AI startup CLEVI ušao među 2,5% najboljih na GAIA-i… pokazao provjerenu vjerodostojnost

Izvor: Digital Times, novinar Gu Bon-gyu

Izvor: Digital Times, novinar Gu Bon-gyu

Cjeloviti citat članka „AI startup CLEVI ušao među 2,5% najboljih na GAIA-i… pokazao provjerenu vjerodostojnost“

Datum objave: 2026-04-08

Poveznica: https://n.news.naver.com/article/029/0003020511?sid=105

Domaći AI startup ‘CLEVI (Clevi)’ objavio je da je, nakon izgradnje vlastitog modela i vlastitog agentnog rješenja razvijenih od nule, kao prvi u Južnoj Koreji ušao među 2,5% najboljih na GAIA benchmarku, prema ukupno 3.090 registriranih modela.

Prema objašnjenju industrije, GAIA, koju je osmislio Meta AI, a kojom upravlja Hugging Face, od AI-ja ne traži ‘sposobnost da dobro radi samo jednu stvar’, već ‘sposobnost kombiniranja više sposobnosti za rješavanje stvarnih problema’. Potrebno je pronaći informacije na webu, pročitati tablicu u PDF-u, analizirati sliku, pokrenuti kod radi izračuna te objediniti rezultate i iznijeti jedan točan odgovor. Struktura s 301 nejavnim pitanjem, tri razine težine i načelom neobjavljivanja odgovora onemogućuje i prekomjerno prilagođavanje i varanje.

Za postizanje visokog rezultata na tom testu potrebne su dvije stvari. Prva je sposobnost zaključivanja jezičnog modela koji čini temelj, a druga je agentno rješenje koje taj model povezuje s alatima stvarnog svijeta i omogućuje mu autonomno izvršavanje zadataka. Bez obzira na to koliko je model dobar, ako je agent slab, nije moguće riješiti Level 3; a koliko god agent bio sofisticiran, ako je sposobnost zaključivanja modela nedovoljna, pogrešni se odgovori šire već u srednjoj fazi.

Promatranjem trenutačne strukture GAIA ljestvice rezultata uočava se zanimljiv obrazac. Većina agenata pri vrhu primjenjuje strategiju ‘miješanja više modela’, kombinirajući više modela velikih tehnoloških kompanija, poput GPT-a, Claudea i Geminija. Riječ je o razumnom pristupu koji objedinjuje prednosti svakog modela i štiti od smanjenja rezultata uzrokovanog gubitkom informacija i sličnim problemima.

CLEVI se, međutim, nije pridružio tom trendu. cip-5.5-agent (agentni AI), razvijen od nule, autonomno obavlja planiranje, izvršavanje i provjeru složenih zadataka, dok cip-5.5-mm (multimodalni model opće namjene visokih performansi) razumije i zaključuje na temelju različitih formata datoteka, uključujući zvuk, slike i videozapise. Oba su modela neovisno razvijena unutar CLEVI-ja, a vanjski LLM API-ji uopće nisu korišteni.

I s ovim vlasničkim skupom modela prijavio je 5 agenata na GAIA-u, a svi su zabilježili rezultate iznad 70 bodova. Od najviših 79,07% do 70,76%, dokazano je da se ne radi o sreći pojedinačnog rezultata, već o stabilnosti cijelog skupa.

Slika u glavnom tekstu

Prema objašnjenju tvrtke, iza službenog rezultata od 79,07% krije se još jedna brojka. Interna naknadna provjera CLEVI-ja pokazala je da je među 301 pitanjem znatan broj onih za koja su dokazi točnih odgovora nestali s trenutačno javno dostupnog weba. Kada se ponovno procijene samo pitanja za koja točan odgovor i dalje postoji na webu, stopa točnih odgovora CLEVI-ja iznosila je više od 98%. To je već iznad ljudskog prosjeka (92%).

Naravno, službeni rezultat mogao se dodatno povećati kombiniranjem snažnih općih modela drugih tvrtki. Međutim, CLEVI je namjerno odabrao strategiju koja to nije uključivala. Cilj ovog benchmarka nije bio natjecanje za najviši rezultat, već provjera je li vlastiti model razvijen from scratch dosegnuo razinu na kojoj se može natjecati na globalnoj pozornici.

To što se ime pojavljuje na GAIA-inoj ljestvici ima veliko značenje jer potvrđuje provjerenu vjerodostojnost koju je dodijelila neovisna procjena treće strane. To je objektivan dokaz koji se može iskoristiti u svim fazama — od privlačenja ulaganja i međunarodnog širenja do B2B prodaje.

Predstavnik CLEVI-ja izjavio je: „Znatan dio od službeno 63 pogrešna odgovora proizašao je iz neusklađenosti izlaznog formata, pogrešnog tumačenja vizualnih materijala i pitanja na koja se nije moglo točno odgovoriti zbog gubitka informacija. Riječ je više o preciznosti naknadne obrade i dostupnosti vanjskih informacija nego o temeljnim ograničenjima logičkog zaključivanja. Budući da je riječ o vlastitom modelu, CLEVI ga može samostalno poboljšavati. To je upravo strukturna prednost vlastitog modela razvijenog from scratch. Ovaj uspjeh CLEVI-ja postavlja korejskoj AI industriji pitanje: „Dokle ćemo ovisiti o ‘posuđenim mozgovima’?” CLEVI je odabrao teži put razvoja from scratch i želi dokazati odgovor na globalnoj pozornici.”

Natrag na redakciju
CLEVI

Jezik i regija

Strojno prevedeni jezici označeni su. Dostupnost prati objavljeni paket web-mjesta.

136 jezika

Preporučeno

1

Istočna Azija

7

Jugoistočna Azija

11

Južna Azija

18

Srednja Azija

5

Bliski istok i Kavkaz

10

Zapadna Europa i Južna Europa

16

Ujedinjeno Kraljevstvo i Irska

4

Sjeverna Europa

10

Srednja Europa i Balkan

14

Istočna Europa

5

Istočna Afrika

8

Zapadna Afrika i Središnja Afrika

9

Južna Afrika

8

Amerike

5

Oceanija

5
AI startup CLEVI ušao među 2,5% najboljih na GAIA-i… pokazao provjerenu vjerodostojnost — CLEVI