Nijs

AI-startup CLEVI komt yn top 2,5% fan GAIA… toant bewiisde leauwensweardigens

Boarne: Digital Times, ferslachjouwer Gu Bon-gyu

Boarne: Digital Times, ferslachjouwer Gu Bon-gyu

Folsleine oanhelling fan it artikel “AI-startup CLEVI komt yn top 2,5% fan GAIA… toant bewiisde leauwensweardigens”

Publikaasjedatum 2026-04-08

Keppeling: https://n.news.naver.com/article/029/0003020511?sid=105

De Koreaanske AI-startup ‘CLEVI (Clevi)’ hat bekendmakke dat it, wylst it in eigen model en in eigen agents oplossing boude dy't from scratch ûntwikkele binne, as earste yn Korea de top 2,5% berikt hat yn 'e GAIA-benchmark, basearre op alle 3.090 registrearre modellen.

Neffens útlis út 'e sektor freget GAIA, ûntwurpen troch Meta AI en eksploitearre troch Hugging Face, AI net om ‘it iene ding goed te kinnen’, mar om ‘ferskate fermogens te kombinearjen om echte problemen op te lossen’. It moat ynformaasje op it web fine, tabellen yn PDF-bestannen lêze, ôfbyldingen analysearje, koade útfiere om berekkeningen te meitsjen, en de resultaten kombinearje om ien korrekt antwurd te jaan. Mei 301 net-publike fragen, trije swierrichheidsnivo's en it prinsipe dat antwurden net iepenbier makke wurde, is it in struktuer wêryn noch oerpassing noch cheating mooglik is.

Om in hege skoare op dizze test te heljen, binne twa dingen nedich. De redenearringsfeardigens fan it ûnderlizzende taalmodel en in agents oplossing dy't dat model ferbynt mei ark út 'e echte wrâld, sadat it selsstannich taken útfiere kin. Hoe goed it model ek is, as de agent swak is, kin Level 3 net oplost wurde; en hoe ferfine de agent ek is, as it model tekoartkomt oan redenearringskrêft, wurde ferkearde antwurden yn in tuskenstadium trochjûn.

As men nei de hjoeddeistige struktuer fan it GAIA-ranglist sjocht, wurdt in nijsgjirrich patroan sichtber. De measte agents yn 'e top brûke in strategy fan ‘multi-model mix’, wêrby't ferskate modellen fan grutte technologybedriuwen, lykas GPT, Claude en Gemini, kombinearre wurde. It is in ridlike oanpak om de sterke punten fan elk model te kombinearjen en skoareferlies troch ûnder mear ynformaasjeferlies te beheinen.

CLEVI hat him lykwols net by dy rige oansletten. De from scratch ûntwikkele cip-5.5-agent (agentyske AI) fiert de planning, útfiering en ferifikaasje fan komplekse taken selsstannich út, wylst cip-5.5-mm (krêftige algemiene multimodale) ferskate bestânsformaten, lykas audio, ôfbyldingen en fideo, begrypt en redenearret. Beide modellen binne selsstannich binnen CLEVI ûntwikkele, en der binne hielendal gjin eksterne LLM API's brûkt.

En mei dizze eigen modelstack hat CLEVI fiif aginten nei GAIA stjoerd, dy't allegear 70 punten of heger behellen. Fan it heechste resultaat fan 79,07% oant 70,76% is bewiisd dat net it gelok fan ien resultaat, mar de stabiliteit fan de hiele stack de krêft is.

Ofbylding yn de haadtekst

Neffens de útlis fan it bedriuw sit der efter de offisjele skoare fan 79,07% noch in oar getal. Ut in ynterne neibeoardieling fan CLEVI die bliken dat by in oansjenlik tal fan de 301 fragen de grûn foar it goede antwurd op it stuit net mear op it iepenbiere web te finen wie. By in nije beoardieling op basis fan allinnich de fragen dêr't it goede antwurd noch op it web stiet, wie it krektenspersintaazje fan CLEVI heger as 98%. Dat leit al boppe it minsklik gemiddelde fan 92%.

Fansels hie CLEVI de offisjele skoare noch heger meitsje kinnen troch krêftige algemiene modellen fan oare bedriuwen te kombinearjen. Mar CLEVI hat dy strategy bewust net keazen. It doel fan dizze benchmark wie om net om de heechste skoare te konkurrearjen, mar te ferifiearjen oft in from scratch eigen model in nivo berikt hat dêr't it op it wrâldtoaniel konkurrearje kin.

Dat de namme fan CLEVI op it GAIA-ranglist stiet, hat grutte betsjutting, om't it giet om ferifiearre leauwensweardigens dy't troch in ûnôfhinklike evaluaasje fan in tredde partij takend is. Dit is objektyf bewiis dat brûkt wurde kin yn alle fazen: it oanlûken fan ynvestearrings, ynternasjonale útwreiding en B2B-ferkeap.

In fertsjintwurdiger fan CLEVI sei: “In grut part fan de 63 offisjele ferkearde antwurden kaam fuort út in net oerienkommend útfierformaat, flaters by it ynterpretearjen fan fisueel materiaal en fragen dêr't it goede antwurd net bepaald wurde koe troch ferlern gien ynformaasje. It giet net om in fûnemintele beheining fan logysk redenearjen, mar om de krektens fan neiferwurking en de beskikberens fan eksterne ynformaasje. Om't it in eigen model is, kin CLEVI it sels ferbetterje. Dat is krekt it strukturele foardiel fan in from scratch eigen model. De prestaasje fan CLEVI ropt yn de Koreaanske AI-sektor de fraach op: ‘Hoe lang sille wy noch ôfhinklik wêze fan in “liend brein”?’ CLEVI hat de dreger wei fan from scratch keazen en wol dat antwurd op it wrâldtoaniel bewize.”

Werom nei de nijsredaksje
CLEVI

Taal en regio

Talen dy’t troch masine oerset binne, wurde markearre. De beskikberens folget it publisearre sitepakket.

136 talen

Oanrekommandearre

1

East-Azië

7

Sûdoost-Azië

11

Sûd-Azië

18

Sintraal-Azië

5

Midden-Easten en de Kaukasus

10

West-Europa en Sûd-Europa

16

Verenigd Koninkrijk en Ierlân

4

Noard-Europa

10

Midden-Europa en de Balkan

14

East-Europa

5

East-Afrika

8

West-Afrika en Sintraal-Afrika

9

Sûdelijk Afrika

8

Amerika

5

Oceanië

5
AI-startup CLEVI komt yn top 2,5% fan GAIA… toant bewiisde leauwensweardigens — CLEVI